Clément Delangue:llama.cpp 支持在设备端运行决策模型
中文全文 · AI 翻译
决策模型现在可以通过 llama.cpp 在设备本地运行。免费、快速、保护隐私!
llama serve -hf ggml-org/Kev-4B-GGUF
https://x.com/ClementDelangue/status/2106037207631008033/photo/1

对照原文
Decision models now run on device in llama.cpp. Free, fast, private! llama serve -hf ggml-org/Kev-4B-GGUF https://t.co/ApnQQaKB4Z