GoogleMODEL GUIDE — GEMINI-3-5-FLASH-LITE

Gemini 3.5 Flash-Lite

商用クラウドモデル最新フラッグシップ世代2026年7月21日(正式リリース) リリース公式サイト ↗

Gemini 3.5 Flash-Liteは、Google DeepMindが2026年7月21日にGemini 3.6 Flashと同時に正式リリースした軽量・超高スループットモデルです。 Gemini 3.5シリーズの中で最も高速かつ低価格に設計されており、1秒間に350トークン以上のスピードで応答を生成します。並列化されたサブエージェントタスクや、コストを最小限に抑えたい大量データの自動処理において絶大なパフォーマンスを発揮します。

コンテキスト許容量1,000,000 トークン
対応フォーマットテキスト、プログラムコード、マルチモーダル
有料プランAPI価格: 入力 $0.30 / 出力 $2.50(1Mトークンあたり)
◆ 公式確定ソース & リリース仕様

公式発表データ仕様 & リリースステータス

Google DeepMindは2026年7月21日、Gemini 3.5 Flash-Liteを正式公開しました。入力 $0.30 / 出力 $2.50(1Mトークンあたり)という高コストパフォーマンスで、Google AI StudioおよびVertex AIにて提供中です。
◇ 次世代スクープ・有力リーク予測

リーク & 予測ロードマップ & X(Twitter)の最新動向

Gemini 3.6 Flashのローンチと同時に、Google AI StudioおよびVertex AIの登録モデルリストに「gemini-3.5-flash-lite」が即時追加され利用可能となりました。

主な強み・メリット

  • 1秒間に350トークン以上の出力を叩き出す圧倒的なスループットと超低レイテンシを実現
  • 入力1Mトークンあたり0.30ドルという破壊的な低価格設定により、大規模自動化ワークフローのコストを劇的に削減
  • Gemini 3.6 Flash等の上位モデルと連携し、オーケストレーターの下で動くサブエージェントとして最適動作

弱み・注意点

  • 最高難度の複雑な数学証明や超大規模システムのリファクタリングでは、上位のProクラスモデルに劣る
  • 出力速度が極めて高いため、クライアント側での受信ストリーミングのバッファリング管理に注意が必要

ビジネスでの具体的な活用シーン

1

複数のサブエージェントを同時に並列稼働させ、大量のテキストやログを数十秒で要約・分類する自動化パイプライン

2

レスポンスの速さがユーザー体験を左右するリアルタイムチャットボットや、高速FAQ検索エンジン

3

毎月数億トークン規模のデータを連続処理する企業インフラでの、API運用コストの大幅な圧縮

CONSULTING & SUPPORT

「どのモデルを、どう社内に導入すべきか」
実務レベルでお悩みですか?

「ChatGPTとClaude、自社にはどちらを契約すべき?」「セキュリティ規約を守りつつ安全にAPIを使うには?」など、具体的な導入戦略から社内ガイドラインの策定まで、BNFのAI顧問が中立的な立場から貴社ビジネスを直接支援します。

BNF公式サイトでお問い合わせ ※外部サイト(bnf.co.jp)へ遷移します