mirror of
https://github.com/shareAI-lab/analysis_claude_code.git
synced 2026-09-21 21:03:38 +08:00
docs: simplify Chinese course prose
This commit is contained in:
@@ -17,7 +17,7 @@ Agent 跑着跑着报错了:
|
||||
Error: 529 overloaded
|
||||
```
|
||||
|
||||
Agent 崩溃了。它没有重试,没有换模型,没有减少上下文——直接崩溃。
|
||||
Agent 崩溃了。它没有重试、切换模型或减少上下文,调用直接终止。
|
||||
|
||||
LLM API 调用可能失败。本章处理三种情况:输出截断、上下文超限和临时故障(429/529)。
|
||||
|
||||
@@ -45,7 +45,7 @@ s10 的循环、prompt 组装全部保留。唯一的变动:LLM 调用包裹
|
||||
|
||||
模型话说一半,`max_tokens` 用完了。默认 8000 token 不够它输出完整回答。
|
||||
|
||||
第一次发生时,直接把 `max_tokens` 从 8K 升级到 64K(8 倍空间),重试同一请求——此时不追加截断输出到 messages,保持原始请求不变。如果 64K 还是不够,才保存截断输出并注入续写提示让模型接着刚才的话继续说,最多 3 次:
|
||||
第一次发生时,直接把 `max_tokens` 从 8K 升级到 64K(8 倍空间),然后重试同一请求。这个阶段不追加截断输出到 messages,保持原始请求不变。如果 64K 还是不够,才保存截断输出并注入续写提示让模型接着刚才的话继续说,最多 3 次:
|
||||
|
||||
```python
|
||||
if response.stop_reason == "max_tokens":
|
||||
@@ -67,7 +67,7 @@ if response.stop_reason == "max_tokens":
|
||||
messages.append({"role": "assistant", "content": response.content})
|
||||
```
|
||||
|
||||
升级只有一次机会,续写最多 3 次。超过就退出——继续续写也不会有实质产出。
|
||||
升级只有一次机会,续写最多 3 次。超过这个上限就退出,因为继续续写也不会有实质产出。
|
||||
|
||||
### 路径 2: 上下文超限
|
||||
|
||||
@@ -86,7 +86,7 @@ except PromptTooLongError:
|
||||
|
||||
### 路径 3: 临时故障
|
||||
|
||||
网络抖动、429 限流、529 过载——这些不是 bug,是分布式系统的常态。
|
||||
网络抖动、429 限流和 529 过载是分布式系统的常态,并不表示代码存在 bug。
|
||||
|
||||
429 和 529 统一走指数退避 + 抖动:第一次等 0.5 秒,第二次等 1 秒,第三次等 2 秒,最多 10 次。加随机抖动让并发请求不在同一时刻重试。连续 3 次 529 过载 → 切换到备用模型(若配置了 `FALLBACK_MODEL_ID` 环境变量):
|
||||
|
||||
@@ -190,9 +190,9 @@ python s11_error_recovery/code.py
|
||||
|
||||
## 接下来
|
||||
|
||||
Agent 现在能在错误中自动恢复了。但它处理的任务仍然是"一次性"的——你给它一个任务,它做完,结束。
|
||||
Agent 现在能在错误中自动恢复了,但仍然一次只处理一个任务:接收任务、完成任务,然后结束。
|
||||
|
||||
能不能让 Agent 管理一个**任务列表**——有依赖关系、持久化到磁盘、跨会话能恢复?TODO 列表不是任务系统。
|
||||
下一步要让 Agent 管理一个具备依赖关系、磁盘持久化和跨会话恢复能力的**任务列表**。TODO 列表无法承担任务系统的职责。
|
||||
|
||||
s12 Task System → 任务是有依赖、有状态、持久化的图。这是多 Agent 协作的基础。
|
||||
|
||||
|
||||
Reference in New Issue
Block a user