Google、速くて安い新AI「Gemini Flash」発表
Google Releases Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber: A Cheaper, More Token-Efficient Flash Tier Built for Agentic Workloads

Googleが速くて安価な新AI「Gemini Flash」を発表。AIが生成する文字の単位(トークン)を効率化し、自動作業のコストを大幅に削減できるため、AIの利用がさらに広がるでしょう。
本番環境でエージェントを構築する開発者は、より高いトークン効率、低いレイテンシ、そしてより信頼性の高いパフォーマンスを必要としています。本日、Googleは3つの新しいGeminiモデルをリリースしました。ラインナップはGemini 3.6 Flash、Gemini 3.5 Flash-Lite、そしてGemini 3.5 Flash Cyberです。これら3つはすべてFlashティアに属しており、Googleは最大の推論深度よりも、速度、コスト、および大量のエージェント作業のために調整しています。Gemini 3.6 Flash: より良い品質、より少ないトークン、より低い価格。Gemini 3.6 Flashは新しいデフォルトの主力モデルです。これは3.5 Flashを基盤とし、コーディング、知識作業、マルチモーダルタスクを対象としています。主なポイントは効率性です。Artificial Analysis Indexでは、3.6 Flashは3.5 Flashよりも出力トークンを17%削減しています。DatacurveによるDeepSWEベンチマークでは、Googleは最大65%の削減を報告しています。このモデルはまた、マルチステップワークフローあたりの推論ステップとツール呼び出しも少なくなっています。価格も効率性と並行して引き下げられています。Gemini 3.6 Flashの価格は、入力トークン100万あたり1.50ドル、出力トークン100万あたり7.50ドルです。出力レートは、3.5 Flashの以前の9.00ドルから引き下げられました。冗長性の低減と出力価格の引き下げにより、エージェントタスクあたりの総コストが削減されます。品質の向上も効率性の向上と同時に実現されています。DeepSWEでは、3.6 Flashは37%だった3.5 Flashに対し49%を記録しました。MLE Benchでは、49.7%だったのに対し63.9%に達しています。OSWorld-Verifiedでは、78.4%だったのに対し83.0%を記録しました。知識作業のベンチマークであるGDPval-AA v2では、1349だったのに対し1421を記録しました。コンピュータの使用は現在、Gemini APIおよびGemini Enterpriseを通じて組み込みのクライアントサイドツールとなっています。HebbiaやHarveyを含む初期の顧客は、ドキュメント解析、チャートおよびデータ分析、レポート作成における成果を挙げています。Googleは、強化されたFrontier Safetyセーフガードを備えた3.6 Flashを出荷しています。これらは、化学、生物、放射性、核(CBRN)およびサイバー攻撃の悪用をカバーしています。詳細については、3.6 Flash model cardをご覧ください。以下のインタラクティブな説明では、各モデルを前身と比較し、自身のボリュームでのトークンコストを見積もることができます。(function(){ window.addEventListener('message',
この記事について質問
記事の内容に答えます。記事外のことは都度ウェブで調べます。