#1912·WrenAI

404 未找到 Ollama 嵌入 API

作者: sharework-ai创建于 2025年8月22日更新于 2026年9月15日
标签bugstale

** 描述错误** 我在窗口11安装了ollama, 并配置嵌入模型如下:

类型:嵌入器 提供者: litellm embedder 模型 :

  • 型号:Ollama/组装文本:最后文本 别名: 默认 api base:http://host.ZDocker. 内部:11434 超时:120

但我得到的错误是:

文件"/app/.venv/lib/python3.12/ site-packages/litellm/utils.py", 第1586行,以包装-async表示. 提高e file "/app/.venv/lib/python3.12/ site-packages/litellm/utils.py", 第1437行,以包装-async 结果 = 等待原始函数(*args, **kwargs) ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^ File "/app/.venv/lib/python3.12/ site-packages/litellm/main.py", 第3577行,以相接为单位 升起例外类型( T) ^^^^^^^^^^^^^^^ 文件"/app/.venv/lib/python3.12/ site-packages/litellm/litellm core utils/unition mapping utils.py",2301行,以"例外"类型. 提高e 文件"/app/.venv/lib/python3.12/ site-packages/litellm/litellm core utils/unition mapping utils.py", 第2270行,以"例外"为类型. 提高 APIConnection 错误 () litellm.unusion. APIConnectionError: litellm. APIConnectionError: Ollama Exception - 客户端错误 '404 Not found' for url 'http://host.ZDocker. 内部:11434/api/embed'

详情查询:https://developer.mozilla.org/en-US/docs/Web/HTTP/status/404⁠

** 废除** 复制行为的步骤 :

  1. 以默认配置运行 Ollama
  2. 拉出LLM模型和组装文本:最
  3. 依据https://docs.getwren.ai/oss/ai service/guide/custom llm,将WrenAI封为文人.
  4. 开始WrenAI
  5. 见集装箱wrenai-service-1的错误

** 预期行为** 集装箱wrenai服务开始得当

** 枪声**

  • 后面的留言说 Ollama 可以在Docker中访问

/mnt/c/用户/plowa/.wrenai$ Docker 运行-rm卷曲图像/曲线-H “Content-Type:应用程序/json” http://host.ZDocker. 内部:11434/api/tags. 总计% 收到% Xferd 平均速度 时间 时间 当前 上传已耗尽的左上方速度 0 0 0 0 0 0 0 0 — — — — — — — — — — — — — — — — — — — “模型” : [{ “名称”: “ 组装文本: latest” 、 “模型” : -embed-text:latest"",已修改为"at":"2025-08-20T13:59:38.871564+08:00"""大小":274302450""digest":"0a109f422b47e3a30b2b10eca18548e944e8a23" 073ee3f3e947efcf3c45e59f","细节":{"父母 模型":""格式":"gguf","家庭":"经济学-伯特","家庭":["经济学-伯特"]"参数 大小":"...... 137M""量子化-水平":"F16""Q",{"名称":"gemma3:270m""模型":"gemma3:270m""被修改"at":"2025-08-20T12:40:54.098435+08:00"""大小":2". 91554930"digest":"e7d36fb2c3b3293cfe56d55889867a064b3a2b22e98335f2e6e8a387e081d6be","细节":{"父母 模型":""格式":"gguf","家庭" ":"gemma3" "家庭":"["gemma3"]"参数 尺寸":"268.10M" "量子化 水平":"Q8 0""}}",{"名":"qwen3:4b" "模型":"qwen3:4b"""被修改". . . . . . . .