Gemini 3.5 Flash-Liteは、Googleが2026年7月21日に発表した、Gemini 3.5ファミリーの中で最も高速かつ低コストなマルチモーダルAIモデルです。圧倒的な生成速度と高い費用対効果を両立しており、大量のデータを高速で処理するタスクに特化しています。
主な特徴と仕様
- 圧倒的なスピード: Artificial Analysisの実測値で毎秒350出力トークンという驚異的な生成速度を記録しています。
- 大容量コンテキスト: 軽量モデルでありながら、最大100万トークンの入力(長文ドキュメント、画像、動画、音声、PDFなど)に対応しています。
- 優れた費用対効果: API料金は、100万トークンあたり入力$0.30/出力$2.50に抑えられています。
- 思考レベルの最適化: 思考レベル(thinking_level)を調整可能。デフォルトは「MINIMAL(最小限の思考)」に設定されており、ルーティングなどの速度重視タスクを最速でこなせます。
主な想定ユースケース
高度で複雑な推論よりも、「スピード」「処理量」「低コスト」が最優先される以下のような業務に最適化されています。
- 大量のテキストの分類やルーティング(仕分け)
- ドキュメントやPDFからのシンプルなデータ抽出・JSON構造化出力
- リアルタイムな応答が必須となるチャットボットの駆動
- 自律型サブエージェントの大規模な同時実行ワークフロー


