Gemini 3.5 Flash-Lite
Gemini 3.5 Flash-Liteは、Google DeepMindが2026年7月21日にGemini 3.6 Flashと同時に正式リリースした軽量・超高スループットモデルです。 Gemini 3.5シリーズの中で最も高速かつ低価格に設計されており、1秒間に350トークン以上のスピードで応答を生成します。並列化されたサブエージェントタスクや、コストを最小限に抑えたい大量データの自動処理において絶大なパフォーマンスを発揮します。
コンテキスト許容量1,000,000 トークン
対応フォーマットテキスト、プログラムコード、マルチモーダル
有料プランAPI価格: 入力 $0.30 / 出力 $2.50(1Mトークンあたり)
主な強み・メリット
- 1秒間に350トークン以上の出力を叩き出す圧倒的なスループットと超低レイテンシを実現
- 入力1Mトークンあたり0.30ドルという破壊的な低価格設定により、大規模自動化ワークフローのコストを劇的に削減
- Gemini 3.6 Flash等の上位モデルと連携し、オーケストレーターの下で動くサブエージェントとして最適動作
弱み・注意点
- 最高難度の複雑な数学証明や超大規模システムのリファクタリングでは、上位のProクラスモデルに劣る
- 出力速度が極めて高いため、クライアント側での受信ストリーミングのバッファリング管理に注意が必要
ビジネスでの具体的な活用シーン
1
複数のサブエージェントを同時に並列稼働させ、大量のテキストやログを数十秒で要約・分類する自動化パイプライン
2
レスポンスの速さがユーザー体験を左右するリアルタイムチャットボットや、高速FAQ検索エンジン
3
毎月数億トークン規模のデータを連続処理する企業インフラでの、API運用コストの大幅な圧縮