Ollama v0.19
ストックにはログインが必要です
MLX で Apple Silicon 上のローカルモデルを大幅に高速化
Artificial Intelligence
GitHub
Open Source
Apple
Ollama v0.19 は Apple Silicon 上で MLX を活用したローカル推論を強化。NVFP4 サポートと会話跨ぎのキャッシュ再利用、スマートなチェックポイント・エビクションの導入により、分岐型エージェントワークフローのメモリ使用量を抑えつつ反応性を向上させる。32GB 以上の Mac で Qwen3.5-35B-A3B NVFP4 の利用が可能で、ローカルの重いワークフローが現実的になる。
投票数: 360