GoogleとOpenAIは、同じ日に「ファストAI」ルートに移動しましたが、ランディングのリズムは異なります。 GoogleはGemini 3.7 Flashのライン上で正式に開いて、開発者に開かれています。OpenAIは、現在、選択したクライアントのテストのために招待されている高速モデルであるGPT-5.6 Sol Ultrafastをプレビューしました。

ジェミニ 3.7 フラッシュは全開です。

GoogleはGemini 3.7 FlashをプログラミングとAIプロキシのシナリオのための一般的なモデルとして位置しました。 テキスト、画像、ビデオ、音声、PDF入力をサポートし、マルチステップのタスクを処理するためのツールや制御コンピュータに電話をかけ、手動介入を減らすこともできます。

Google で公開されたデータによると、Gemini 3.7 Flash は、64,000 トークンの出力天井で最大 1,000,000 の入力トークンを受け取ることができます。 Googleによると、ソフトウェアエンジニアリング、Web開発、複雑な知識タスクの以前の世代よりも優れたバージョンが実行され、より迅速に対応します。

Googleは、例えば、テストされたコーディングのミッションで、Gemini 3.7 Flashは2分13秒を費やしましたが、以前の世代のFlashは5分以上かかりました。 同時に、Googleは新しいモデルが速度の交換の質を減らすことを意図されていないことを強調しました。

価格は下がり続けます。

スピードに加えて、Googleは販売ポイントとして低コストを使用しています。 テキストの情報によると、Gemini 3.7 Flashは、今年の終わりまでに値付けられました。

  • トークンチャージ $ 0.75 /百万
  • 百万トークン
  • この価格はGemini 3.6 Flashの初期価格の約半分です。

上記の優遇価格が増加します。 $1.50 百万の入力と $7.50 百万の輸出後 31 12 月.

パフォーマンス比較の観点から、GoogleはGemini 3.7 Flashが18の試験カテゴリのうち、Code ArenaのWeb開発スコア1588 Eloおよびエンタープライズワークストリームテストベンチの1セントあたり30.4を含む、11をリードしたホームベースのベンチマーキングテストを引用しました。 しかし、これらの結果はGoogle独自の方法に基づいています。

OpenAIのメインヒットが速くなりました。

OpenAIはGPT-5.6 Solの超高速モデルではなく、新しいモデルではありません。 レポートによると、このモデルはCerebrasによってサポートされています。これはGPT-5.6 Sol規格の14回で実行できます。

Cerebrasの結晶円周チップは毎秒750トークン、毎秒約560英単語を生成すると言われています。 OpenAIは、音声エージェントなどのリアルタイムシーンでこの速度の重要性を強調しようとしています。例えば、電話通話中に推論と応答の迅速な完了によるものです。

しかし、Googleの直接開口部とは異なり、GPT-5.6 Sol Ultrafastは現在OpenAI APIの少数のクライアントにのみ利用可能であり、経済が拡大するにつれて、徐々にビジネスユーザーの数が増えます。 OpenAIは、他のモデルと高速モデルの肯定的な系統的比較を公表していません。この段階でクライアントのフィードバックへのより多くの言及。

競争の焦点はリアルタイムの代理店にシフトしました。

この同時リリースは、AIメーカーの競争の変革の焦点を反映しています。 市場焦点は「誰が賢い」の単なる比較から「誰がリアルタイムエージェントをサポートするのに十分速い」に移行しています。 スピードは、継続的な課題を要求し、ユーザーに即応する製品に対する経験のより直接的な指標になっています。

Googleは、現在の可用性の面で先駆的です。 ジェミニ 3.7 Flashは160以上の国や地域にオンライン化されており、開発者が直接呼び出すことができます。OpenAIのhypervelocityモデルは、短期的なカバレッジが限られているため、招待状ステージでもあります。