Ollama v0.19 logo

Ollama v0.19

MLX で Apple Silicon 上のローカルモデルを大幅に高速化

Artificial Intelligence GitHub Open Source Apple

Ollama v0.19 は Apple Silicon 上で MLX を活用したローカル推論を強化。NVFP4 サポートと会話跨ぎのキャッシュ再利用、スマートなチェックポイント・エビクションの導入により、分岐型エージェントワークフローのメモリ使用量を抑えつつ反応性を向上させる。32GB 以上の Mac で Qwen3.5-35B-A3B NVFP4 の利用が可能で、ローカルの重いワークフローが現実的になる。

投票数: 360
← 投稿一覧に戻る