Gemini 3.1 Flash-Lite logo

Gemini 3.1 Flash-Lite

大量のAIパイプライン向けの軽量なGeminiモデル

Artificial Intelligence Developer Tools API

Gemini 3.1 Flash-Lite は高ボリュームAIパイプライン向けの軽量Gemini 3モデル。ツール呼び出しとエージェントオーケストレーションに最適化され、マルチモーダル(テキスト+画像)対応。構造化タスクの p95 レイテンシはサブセカンド、全応答の p95 は約1.8秒、同時実行下の成功率は約99.6%、推論コストは推論階層モデルより低い。大規模運用の分類・ルーティング・翻訳・モデレーション・オーケストレーションを効率化。GAリリース後のコスト効率と実行層の位置づけが議論の焦点。適用例はリアルタイムUI連携やデータルーティングなど。

投票数: 153
← 投稿一覧に戻る