Googleが8月13日にGemini 3.7 Flashをリリースすると、価格のセットを覚えやすくなりました。トークン$ 0.75 /百万ドル、前世代の3.6フラッシュの初期価格のわずか半分で、年中有効$ 3.75を費やしました。 しかし、モデルが再び安くなっていたことではなく、Googleは以前のバージョンのFlashを3週間だけ別々に置き換えた。 シミュレーションは、年間リリースからクラウド型サービスの継続的な配信に移行します。

企業がAIを調達する方法を変える。 過去には、その周りで適用される前に、チームは「モデルが最も可能である」とよく尋ねています。モデルが価格と直接バックラッシュで3週間でアップグレードされる可能性が高い場合、より現実的な質問が高まっています:それがどれくらいの費用、どのように多くのリターンと多くの人々がそれを見るために必要ですか? モデリングリストはまだ重要ですが、生産環境の成功や失敗を決定するのに十分ではありません。

Googleが指定したデータは、このシフトをサポートしています。 ジェミニ 3.7 以前の世代に1セントから43.6に34.4からFerlinCode 1.1メインバラ、DeepSWE v. 1.1から49.0パーセントから65.3パーセント、WebDev ArenaのEloスコア1538〜1588。 GDP.pdfのベンチマークは、1セントあたり22.0から34.0に増加しましたが、オートメーションベンチは1セントあたり17.0から30.4に増加しました。 これらの数字は、Googleと関連ベンチマークから来ており、すべての実際のビジネスパフォーマンスと直接装備することはできませんが、彼らは同じ製品目標を指しています:フラッグシップモデルに与えられた仕事の多くに安価なモデルを配置します。

格安はトークンが少ないだけではありませんが、リターンが少ないです。 料金について

モデルを使用する最大のコストは、多くの場合、API 価格リストではありません。 コードが初めて固定されていないとき、コンテキストは再登録されます。エージェントがツールを呼び出すと、間違ったステップはトークンの無駄であり、エンジニアの ' s キューイングの時間です。そして生成ページが完了すると、キーインタラクションが欠落し、後ろの手動修理は書き換えよりも高価になる可能性があります。 したがって、入力価格の半分は、成功の最初のラウンド、指示とツールの使用が改善を伴う場合、運用コストの実質的な削減にのみ翻訳されます。

Googleの「レスレトリー」と「レスマニュアルの監督」に重点を置いていると、フラッシュのポジショニングがもはや素早く問題なくモデルに答えることが示唆されています。 進行中のプロキシワークフローを入力することを意図しています。情報を読み、タスクを解体し、ツールを呼び出し、障害が発生したときに再ルートし、処理を続けることができる結果を届けることです。 このタイプの作業では、単一の控除価格だけでなく、クローズドリングが呼び出されるまでに数回、占有するコンテクストの数、故障後に自己補正できるかどうかを判断します。

公共価格では、3.7 Flash の s 入力価格 2026 の最後には $0.75 で、その出力価格は USD 3.75 でした。USD 1.50 と USD 7.50 に 1 1 1 月 2027 のように変換します。 今回限定した半額は、それ自体がマイグレーション戦略です:まず、開発者をGoogleのエコロジーに十分な低コストで引き付け、AI Studio、Android Studio、Gemini Enterprise、および個人エージェントスパークにモデルを入手します。 価格はスタンドアローンのプロモーションではありませんが、モデル、ツール、ワークスペースポータルがワークフローを競争するための手段です。

第3週目は新しい問題をもたらします。 6ヶ月でモデル評価を完了し、長期的にバージョンをロックする企業にとっては困難です。 能力、価格、セキュリティ戦略は急速に変化し、テストおよびリターン機構は正常性に従う必要があります。 今日信頼できると証明したインジケータとツールのプレゼンテーションは、必ずしも次のエディションで同じパフォーマンスを持っていません。モデルはよりスマートであり、移行のコストが自動的に消えることを意味しません。

翌日の作業を安定性で嚥下できるビッグモデルの次の戦い?

ジェミニ 3.7 Flashは「最も強いモデル」という4つの単語をターゲットにしませんでしたが、代わりにコーディングやエージェンシーのための「メインパワーモデル」と呼ばれていました。 用語は非常に正確です: 企業が本当に必要なことは、時折驚きの実証ではありませんが、数千回、推定コストで、間違いが発見できる仕事の馬。 フラッグシップモデルは、開口容量のキャップを担いますが、フラッシュタイプモデルは、容量をスケールに変える責任があります。

Google はまた 3.7 を取り替えました 個人エージェントスパークで直接フラッシュ。 スパークは、160を超える国でAI ProとUltraのサブスクリプションにオープンし、ワークスペース関連のミッションを継続的に実行できます。 つまり、モデルのアップグレードは、API のバックステージだけでなく、メール、ドキュメント、カレンダー、チームワークにすぐに配置されます。 日々の仕事に近いほど、モデルの値は、単一のテストで最高スコアよりも、信頼性と権限の境界に依存します。

安全に、新しいモデルは、化学、生物学的、放射線学的、核関連リスクおよびサイバー攻撃の誤用に対する保護を強化するGoogleの国家。 プロキシモデルの場合、これは子会社の規定ではありません。 テキストのみを生成するモデルのエラーは通常、回答にとどまります。ツールを呼び出すことができるモデルのエラー、ファイルを変更したり、ビジネスシステムを操作したりすると、影響を無視します。 したがって、権限の制御と容量の増強が同期されなければならないと企業は、メーカーの「安全声明」のための独自の承認、ログおよびロールバック機構を代入することはできません。

ジェミニ 3.7 Flashの信号は、ビッグモデルの競争が「最も困難な質問に答えることができる」から「最も低い合計コストでほとんどのルーチンタスクを行うことができます。」に動いていることです。 半額は入り口で、3週間の反転速度は圧力の源です。 開発者にとって、最も重要な将来の機能はモデルを誓うことはできませんが、アプリケーションがモデルを常に評価、切り替え、バインドすることを可能にします。 モデルは、容量が絶えず変化し、本当に障壁を作成することは、それらの周りにワークフローです。