Cohere 表示,Command A專門為中小型企業環境設計,其支援256k的上下文長度和23種語言,作為比較,其他競爭對手的「同類模型」需要32顆GPU 才能部署。
在性能測試中,Command A 最快每秒可以輸出156個Token,據稱比GPT-4o快1.75倍。而在指令追蹤、SQL、代理程序和工具任務的基準測試上,Command A 也表現出色。
Cohere 援引相應性能數據,聲稱業界的大語言模型如果「規模過大」,反而在輸出結果時可能會出現嚴重的延遲問題;如果只是想快速得到正確答案,Command A相對是個不錯的選擇。
目前,Cohere已將相應Command A發表在Hugging Face 平台,對學術界開放使用,未來還會登陸其他雲服務平台。
