AI AIモデル「Qwen」27B版の推論性能が2倍に、llama.cppを高速化 ローカルAIエージェント向けの推論基盤llama.cppが、先読み検証とGPU上の実行順序の改善で高速化した。NVIDIAによると、Qwenの2… 2026.06.05