G0DM0D3故障排查大全:连接失败、无模型返回、响应慢一网打尽
G0DM0D3故障排查大全连接失败、无模型返回、响应慢一网打尽【免费下载链接】G0DM0D3LIBERATED AI CHAT项目地址: https://gitcode.com/GitHub_Trending/g0/G0DM0D3G0DM0D3 是一款完全开源的多模型 AI 聊天界面LIBERATED AI CHAT支持 OpenRouter、Venice 与本地模型。本文是一份G0DM0D3 故障排查大全系统讲解连接失败、无模型返回、响应慢三大常见问题的排查步骤新手照做即可快速恢复。 快速自检先定位是哪一类故障不同症状对应不同原因先看这张速查表症状最常见原因参考章节Connection failed/Failed to fetch本地模型服务未启动、CORS 未配置第一章提示缺少 API keyOpenRouter / Venice 密钥未填第一章Server returned no model IDs模型列表接口返回格式不对第二章响应明显变慢、超时参赛模型过多、Max Tokens 过高第三章429/ rate limit 报错触发限流或套餐档位不足第四章错误类型的完整定义可查阅 PAPER.md项目将失败归类为timeout、rate_limit、auth、model_error、empty、early_exit、unknown七类对号入座即可缩小排查范围。一、连接失败Failed to fetch排查步骤这是最常见的报错界面会直接显示Connection failed: ... Check server CORS.相关逻辑见 index.html。按以下顺序逐一排查1.1 确认本地模型服务器已启动如果你配置的是 Ollama、LM Studio、llama.cpp 或 vLLM 等本地服务先确认服务正在运行# Ollama 示例 ollama pull qwen3:8b ollama serve然后在设置 → API Keys → Local Models填写http://localhost:11434/v1点击Test Discover Models重新连接。本地端点仅允许localhost、127.0.0.1与::1详细配置见 LOCAL_MODELS.md。1.2 检查跨域CORS配置浏览器默认阻止跨域请求。使用托管页面连接本地服务时必须让本地服务器放行对应的浏览器来源origin。以 Ollama 为例需在 origin 配置中包含托管页面地址后重启服务器LM Studio 则需在 Developer 面板开启 CORS。说明详见 LOCAL_MODELS.md。1.3 确认 API 密钥已正确填写使用 OpenRouter 或 Venice 云模型时密钥缺失会直接抛出OpenRouter API key is missing.或Venice API key is missing.见 index.html。请检查✅ 密钥粘贴时没有多余空格✅ 密钥在对应平台仍然有效✅ 密钥填在正确的输入框OpenRouter 与 Venice 是分开的 提示密钥仅保存在浏览器本地存储中不会随遥测数据上传但请定期到平台后台核对。二、无模型返回No Models Returned排查点击测试连接后若提示Server returned no model IDs说明请求通了但没拿到模型。核心检查点只有一个确认GET base-url/models返回的是 OpenAI 风格的 JSON{ data: [ { id: qwen3:8b } ] }返回了 HTML 或 404 → base URL 写错了应指向/v1结尾的地址返回了data但为空 → 本地服务还没加载任何模型先在服务里 pull / load 一个模型需要区分多个模型时可在模型 ID 输入框填逗号分隔的多个 ID 一起参赛官方文档对这一症状的原文说明见 LOCAL_MODELS.md。三、响应慢的优化技巧G0DM0D3 的多模型竞赛ULTRAPLINIAN本身是并行请求多个模型再择优模型越多越慢。按性价比从高到低尝试降低模型档位ULTRAPLINIAN 提供 FAST12→ ULTRA60五档档位越高参赛模型越多。日常使用选低档即可详见 README.md减少参赛模型数本地模式下配置一个模型代替多个速度提升最明显关闭附加功能在设置中禁用 coaching 或 Liquid refinement 等后处理调低 Max Tokens在设置中减小最大生成长度选择更快的一级模式ULTRAPLINIAN 约 10-15 秒返回最佳单模型结果CONSORTIUM蜂群合成需 30-60 秒仅在需要综合多方答案时使用对比见 API.md以上优化建议同样来自 LOCAL_MODELS.md 的官方排障章节。四、429 限流与模型报错速查4.1 看懂限流报错自托管 API 的限流由内存滑动窗口实现返回429及X-RateLimit-*响应头中间件见 HF/api/middleware/rateLimit.ts。套餐档位与限额如下档位每分钟每天可解锁档位Free默认1050fast10 模型Pro601,000fast standard smartEnterprise30010,000全部档位遇到429时先等一分钟再试持续触发则检查GODMODE_TIER_KEYS是否为该密钥分配了更高档位配置方法见 API.md。4.2 其他常见错误类型错误类型含义处理建议timeout模型响应超时换低档位、减少模型数auth认证失败核对 API 密钥是否有效model_error模型侧报错多为上游服务波动重试或换模型empty返回空内容检查 Max Tokens 与提示词错误分类逻辑可参考 HF/api/lib/metadata.ts。五、模型拒绝参数怎么办如果本地服务提示拒绝某个采样参数如某些模型不支持top_k官方建议升级本地推理服务到最新版本或开启该服务的OpenAI 兼容模式G0DM0D3 对本地请求会发送标准 chat-completion 字段并自动省略云端专属参数但兼容性最终取决于本地服务本身。该条排障建议见 LOCAL_MODELS.md。 附相关文档与模块路径速查资料路径用途本地模型排障LOCAL_MODELS.md官方 Troubleshooting 章节完整 API 参考API.md端点、档位、限流研究文档PAPER.md模块与错误分类遥测端点functions/api/telemetry.ts元数据上报逻辑自托管 APIapi/server.tsExpress 服务入口隐私条款TERMS.md三层数据透明策略 隐私提醒开启设置 → General → No-Log Mode可关闭应用遥测并清空待发缓冲Local-only 模式则同时排除所有云端模型调用是本地排查时的最佳组合。总结G0DM0D3 故障排查记住三步走 —— 先看症状定章节连接类问题查服务是否启动 CORS 密钥数据类问题查/models返回格式慢的问题从降档位、减模型、关后处理入手。掌握这份清单绝大多数问题都能 5 分钟内解决。【免费下载链接】G0DM0D3LIBERATED AI CHAT项目地址: https://gitcode.com/GitHub_Trending/g0/G0DM0D3创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考