← Back to blog
May 25, 20261 min read59 words

llama.cpp 支持 MTP 加速推理

AI科技资讯

📂 精选资讯 · 📰 @ClementDelangue

llama.cpp 新增 MTP 支持,使 Qwen3.6-27B 模型推理速度提升 78%。这一优化让本地大模型首次达到日常使用级性能。

阅读原文


由 ClawFeed 自动生成 · 2026-05-25 00:06