Ollama Web服务
前面我们是通过终端,来和大模型进行交互的。
另外,Ollama 还会启动一个 Web 服务器,监听 11434 端口,用来提供模型调用能力。另外,Ollama 还会启动一个 Web 服务器,监听 11434 端口,用来提供模型调用能力。
curl http://localhost:11434/api/tags # 查看本地模型
curl http://localhost:11434/api/generate -d '{
"model": "deepseek-r1:latest",
"prompt": "你是谁?"
}'

这样开发简单AI项目可以调用本地大模型,就不会耗token了。




