Gemini 3.5 Flash-Liteと無料でチャット
Gemini 3.5 Flash-Lite:低レイテンシ・高スループット処理に最適化されたGemini AIモデル
Gemini 3.5 Flash-Liteは、Gemini 3シリーズに新たに加わった軽量・高速なGemini AIモデルです。Googleが提供するネイティブマルチモーダル推論モデルとして、高いパフォーマンスを維持しながら、次世代のAIアプリケーションやAIエージェントの実運用を支えるために設計されています。
大量リクエストを低コスト・低レイテンシで処理できるよう最適化されており、高速なレスポンスと優れたコスト効率を両立しています。さらに、複雑なエージェント型ワークフローにもネイティブ対応しているため、リアルタイムでの判断や継続的なタスク実行が求められるAIエージェントの基盤モデルとしても最適です。
Gemini 3.5 Flash-Liteの基本仕様
| 項目 | Gemini 3.5 Flash-Lite |
| コンテキストウィンドウ | 最大100万トークン |
| 入力形式 | テキスト・画像・音声・動画・PDF |
| 出力形式 | テキスト |
| 推論機能 | 対応(Minimal / Low / Medium / High) |
| 最適な用途 | 大量処理・低レイテンシが求められる推論タスク |
Gemini 3.5 Flash-Liteの主な特徴
柔軟に調整できるThinkingレベル:Gemini 3.5 Flash-Liteでは、Minimal・Low・Medium・Highの4段階から推論レベルを選択できます。タスクの複雑さに応じて推論の深さを調整できるため、高速処理から高度な推論まで幅広い用途に対応します。
優れた低レイテンシ性能:Gemini 3.5シリーズの中でも最も高速なモデルとして設計されており、Artificial Analysisの計測では毎秒約350トークンの生成速度を実現しています。
Computer Useを標準サポート:ソフトウェアやデジタルインターフェースを直接操作できるComputer Use機能を備えており、AIエージェントによる自動化タスクをより安定して実行できます。
優れたコスト効率:100万入力トークンあたり0.30ドル、100万出力トークンあたり2.50ドルという価格設定で、Gemini 3.1 Flash-Liteと比較してより高品質な推論性能を実現しています。
Gemini 3.5 Flash-Liteに適したユースケース
大量のドキュメント処理:テキスト・画像・PDFをまとめて処理し、情報抽出や要約を高いコスト効率で実行できます。
リアルタイム検索・分類:ライブ検索、コンテンツモデレーション、大規模データ分類など、高スループットが求められるエンタープライズ環境でも高速なレスポンスを実現します。
コード生成・開発支援:コード生成やデバッグ、コード補完を高速に実行できるため、レスポンス速度が重要な開発ワークフローにも適しています。
Gemini 3.5 Flash-Liteと他のGeminiモデルを比較
| 項目 | Gemini 3.5 Flash-Lite | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
| 主な特徴 | 低レイテンシ・高スループットを重視。高速かつコスト効率に優れたAIエージェント向けモデル。 | 速度と推論性能のバランスを追求した次世代モデル。 | 高速推論を重視した標準モデル。一般的な業務アプリケーションやツール連携に適しています。 | 長いコンテキスト処理と高度な推論に強みを持つ上位モデル。 |
| 入力料金(100万トークン) | $0.30 | $0.75〜$1.50 | $1.50 | $7.00 |
| 生成速度 | 約350 tokens/秒 | 約140 tokens/秒 | 約136 tokens/秒 | 約60〜70 tokens/秒 |
| Computer Use | 対応 | 対応 | 対応 | 一部対応 |
| Thinkingレベル | Minimal / Low / Medium / High | Minimal / Low / Medium / High | Minimal / Low / Medium / High | Low / Medium / High |

その他のモデルもご覧ください
HIX AIでチャットできる、その他の最先端モデルもぜひご覧ください。




