本地大模型(Local LLM)
在自己电脑或服务器上运行的大模型(通常用 Ollama、llama.cpp 等工具)。数据完全不出本机,无 API 费用;受限于本地算力,模型规模通常小于云端旗舰。
本地运行大模型最流行的工具:一行命令下载和运行开源模型(ollama run qwen3:8b),自动管理模型文件,提供 OpenAI 兼容接口。Mac/Windows/Linux 全支持,是本地 AI 的事实入口。
在自己电脑或服务器上运行的大模型(通常用 Ollama、llama.cpp 等工具)。数据完全不出本机,无 API 费用;受限于本地算力,模型规模通常小于云端旗舰。
公开权重可自由下载部署的大模型(Llama、Qwen、DeepSeek 等)。优势是数据不出本地、可微调定制、无 API 依赖;代价是需要自己管算力和运维。
按 OpenAI 的请求/响应格式实现的接口,让同一套代码可以切换不同厂商或本地模型(DeepSeek、通义、Ollama 都提供)。迁移成本一降,模型真正变得可替换。