企業のクライアントは、AI の展開コスト、特に大規模なモデルコールの継続的な増加の状況に焦点を当てています。 Writerは、この圧力ポイントをターゲットにするための新しいモデルとツールをリリースしました。 業務利用習慣を変更することなく、実現コストをできるだけ低く抑えます。

Palmyra X6 導入企業

Writerは新しいフラッグシップモデル、Palmyra X6をリリースしました。 モデルは、Z.ai Open Source Model GLM-5.2 のポストトレンディングバージョンに基づいており、ベンチマークテスト結果を求めるのではなく、企業によって直接使用するために配置されています。

同社によると、Palmyra X6は、他のWriterモデルと並行して提供され、AzureやAmazonのBetrockを通じてアクセスされた外部モデル、顧客は、単一のモデルの周りにシステム全体を再構築する必要はありません。

トークンコストをターゲティングするアップグレードを実施

新しいモデルで公開され、Writer標準の大きなアップグレードがありました。 焦点はモデルそのものではなく、そのマルチステップのタスクを遂行するモデルの動き、呼び出し、推論の過程でもあります。

  • 新しいモデルはPalmyra X6です
  • GLM-5.2ベースモデル
  • 基本的なタスクのコストは、最大50パーセント削減できます

Writerは、新しいモデルが、インフラの調整のこのセットで、クライアントのための基本的なタスクのコストで50パーセント削減をもたらすことを期待しています。 当社は、複雑なタスクがより少ないトークンで完了し、より速く完了した場合、全体的な展開コストが大幅に削減されると強調した。

プロセス最適化と呼ばれる研究より効果的

作家のリサーチチームによる最近の論文もこの審査をサポートしています。 紙は、異なる実装プロセスの下でさまざまなモデルのコスト変化をテストし、多くの場合、自然な効率の最適化が単純な交換モデルよりも安定していたことを示しています。平均的なコストの減少は40パーセントです。

ライターCEOの5月、ハビブは、新しいベンチマークテストの継続的な追求におけるビジネスクライアントの関心が分かち、コストの安定化に向けた焦点がシフトされたと述べた。 また、一部の企業のテクニカルマネージャーによる大規模なAI研究所の信頼は、後者の ' s のビジネスモデルがトークン使用と非常に相関しているため、デクライニング、インター エイリアです。