1
BaseRT:专为 Apple Silicon 优化,让 Mac 本地大模型快 6.4 倍
Apple Silicon上跑本地大模型,BaseRT用M5 Tensor Core让提示词处理速度飙升6.4倍,开源实测数据亮眼。
Apple Silicon 跑本地大模型,速度还能再提升多少?BaseRT 给出了一个答案:在 M5 Pro 上,它的提示词处理速度最高达到 llama.cpp 的 6.4 倍,MLX 的 3.9 倍 BaseRT 是一款专为 Apple Silicon 优化的本地 AI 推理引擎,可以运行 Qwe