Gemini 3.1 Flash-Lite
ストックにはログインが必要です
大量のAIパイプライン向けの軽量なGeminiモデル
Artificial Intelligence
Developer Tools
API
Gemini 3.1 Flash-Lite は高ボリュームAIパイプライン向けの軽量Gemini 3モデル。ツール呼び出しとエージェントオーケストレーションに最適化され、マルチモーダル(テキスト+画像)対応。構造化タスクの p95 レイテンシはサブセカンド、全応答の p95 は約1.8秒、同時実行下の成功率は約99.6%、推論コストは推論階層モデルより低い。大規模運用の分類・ルーティング・翻訳・モデレーション・オーケストレーションを効率化。GAリリース後のコスト効率と実行層の位置づけが議論の焦点。適用例はリアルタイムUI連携やデータルーティングなど。
投票数: 153