立即與 Gemini 3.5 Flash-Lite 聊天
Gemini 3.5 Flash-Lite:專為低延遲、高吞吐量任務而設計
Gemini 3 系列產品線剛剛迎來了其輕量級領域的最新重量級競爭者:Gemini 3.5 Flash-Lite。作為 Gemini 3 系列高效能原生多模態推理模型的最新傑作,這款引擎是為下一代 AI 部署而精心打造的。
Gemini 3.5 Flash-Lite 專為處理高併發、低延遲任務而優化,在控制預算的同時,提供極速效能與卓越的性價比。它不僅速度驚人,還原生支援複雜的Agent工作流,是需要快速即時決策的自主 AI Agent的理想基礎架構。
Gemini 3.5 Flash-Lite規格概覽
| 規格 | Gemini 3.5 Flash-Lite |
| 上下文視窗 | 100 萬 Token |
| 輸入方式 | 文字、圖像、音訊、視訊、PDF |
| 輸出 | 文字 |
| 推理 | 支援(推理力度支援:極低、低、中、高) |
| 核心場景 | 高併發、對延遲敏感的推理任務 |
Gemini 3.5 Flash-Lite的核心功能
靈活的推理力度: Gemini 3.5 Flash-Lite 有四種模式-最小、低、中、高-可根據任務的複雜性動態調整推理深度。
低延遲:3.5 Flash-Lite 是 3.5 系列中最快的模型。根據 Artificial Analysis 的實測,其生成速度可達 350 tokens每秒輸出。
內建計算機控制能力:使 Gemini 3.5 Flash-Lite 能夠透過與跨平台的軟體和數位介面直接互動,可靠地執行智能體任務。
極致性價比: Gemini 3.5 Flash-Lite 的定價為每百萬輸入 Token 0.30 美元,每百萬輸出 Token 2.50 美元,其生成品質顯著優於 Gemini 3.1 Flash-Lite。
Gemini 3.5 Flash-Lite 的理想應用場景
高併發文件處理:以極具成本效益的速度攝取大量文字、影像和 PDF,以即時擷取結構化資訊和摘要。
即時搜尋與分類:為高吞吐量企業管道提供亞秒響應時間,包括即時語義搜尋、內容審核和大規模資料分類。
編碼任務:在低延遲至關重要的場景下,提供近乎即時的程式碼生成、例行除錯支援以及快速自動完成建議,從而加速開發流程。
Gemini 3.5 Flash-Lite 與其他 AI 模型對比
| 規格 | Gemini 3.5 Flash-Lite | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
| 核心定位 | 低延遲、高吞吐量的智能體任務。專為大規模應用而打造,兼顧速度與成本效益。 | 新一代均衡推理。專為需要高速度與更聰明執行的主流生產管線設計。 | 標準高速推理。主流企業應用和工具編排的原始基準。 | 高容量上下文處理。適用於大型上下文視窗和穩定企業推理的傳統基準標準。 |
| 輸入定價 (每百萬 Token) | 0.30美元 | 0.75美元 – 1.50美元 | 1.50美元 | 7.00美元 |
| 生成速度 | 約 350 tokens/秒 | 約 140 tokens/秒 | 約 136 tokens/秒 | 每秒約 60-70 tokens |
| 計算機控制能力 | 原生支援 | 原生支援 | 原生支援 | 有限的 |
| 推理力度支援 | 最低、低、中、高 | 最低、低、中、高 | 最低、低、中、高 | 低、中、高 |

探索我們的其它模型
在 HIX AI 上探索更多可以與之聊天的尖端模型。
Gemini 3.6 Flash
Gemini 3.5 Flash
Gemini 3.1 Pro
GPT 5.6 Terra
GPT 5.6 Luna
GPT 5.5



