mirror of
https://github.com/kuaifan/dootask.git
synced 2026-07-31 18:35:56 +00:00
1.9 KiB
1.9 KiB
id, title, type, feature, scope, locale, aliases, related_tools, related_pages, prerequisites, negative, last_verified
| id | title | type | feature | scope | locale | aliases | related_tools | related_pages | prerequisites | negative | last_verified | ||||||||||
|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|---|
| common-faq.ai-slow.faq | AI 回复很慢 | faq | common-faq | end-user | zh |
|
|
|
v1.7.90 |
AI 回复很慢
问题
AI 助手发问后等很久才出第一个字,或一句话流式吐字过慢,整体感受卡顿。
原因
AI 回复时延受多重因素影响:
- 模型本身:GPT-4 / Claude Opus / Gemini Ultra 等大模型首 token 延迟天然较长(2-10 秒),思考模型可达 30 秒以上
- 供应商网络:国内访问海外 API 走代理 / 国外节点,加上 5-20 秒
- 上下文太长:会话越长 token 越多,处理时间线性增加
- 工具调用串行:一次回复触发多次工具调用会逐次执行,叠加时延
- dootask-ai 容器负载:插件容器 CPU 满 / 内存吃紧
- 流式断开重连:网络抖动让 SSE 中断,前端自动重连看着像卡
解决
- 等待,部分模型「思考」阶段就是慢
- 简化问题,避免长上下文
- 让管理员换更快模型(如 GPT-4 mini、Claude Haiku、deepseek-chat):system-setting.ai-bot.howto
- 让管理员排查 ai 插件容器:
docker stats dootask-ai、docker logs dootask-ai - 改供应商代理 / Base URL,使用更近的中转节点
- 网络抖动 → 切到稳定网络重试
不支持
- 用户端无法在请求中途强制切模型
- 无内置「响应慢自动降级」机制
- 中断回复只能整体停止本轮,不能保留已生成的文本继续