ガジェット llama.cpp v0.6.0公開:GLM-5.3-Flash対応とMetal高速化でローカルLLMの限界を突破せよ ローカルLLM実行環境のデファクトスタンダード「llama.cpp」がv0.6.0へメジャーアップデート。GLM-5.3-Flashへの対応やMetalバックエンドの行列演算最大3倍高速化など、我々エンジニアが待ち望んだ「実用的な推論速度」への最適化が遂に実装された。 2026.10.06 ガジェット