1. 数据能流起来,还不够
前两篇讲了两件事:
- 同一份输入可以并行处理
- 不同输入可以走不同分支
但链路能跑起来,不等于上线以后就稳。
在真实项目里,最容易被忽略的问题其实是:
某一段链突然失败了怎么办。
对 AI 伴侣这类直接面向用户的产品来说,失败一般不只一种:
- 模型请求超时
- provider 限流
- 服务偶发抖动
- 输出格式不对,parser 解析失败
- 某个模型临时不可用
如果整条链没有容错层,任何一段失败都会直接把异常抛给用户。
这一篇要讲的,就是 LCEL 里最常用的两个容错工具:
withRetry()withFallbacks()
但这次不只讲普通链,而是把它接回 Agent 场景里看。
2. withRetry() 解决的是临时性错误
withRetry() 适合处理这样一类问题:
- 再试一次,可能就恢复了
比如:
- 网络超时
- 429 限流
- provider 偶发 500
最简单的用法是直接加在某个 Runnable 上:
1const safeModel = model.withRetry({2stopAfterAttempt: 3,3})
这里的 stopAfterAttempt: 3 表示总共尝试 3 次。
第一次算 1 次,后面再补 2 次重试。
如果这 3 次都失败,错误才会真正抛出来。
在实际项目里,最常加 retry 的位置通常不是整条链,而是模型这一层。
因为最容易抖动的,往往就是外部模型调用。
3. withFallbacks() 解决的是这条路本身不通
有些错误不是“再试一次可能就好”,而是这条路本身暂时不适合继续走。
比如:
- 当前模型临时不可用
- 某个 provider 正在抖
- 输出格式始终不稳定
这时候更需要的不是 retry,而是切到备用链。
1const primaryChain = prompt.pipe(primaryModel).pipe(parser)2const backupChain = prompt.pipe(backupModel).pipe(parser)34const safeChain = primaryChain.withFallbacks([backupChain])
它的执行顺序很直接:
- 先跑主链
- 主链失败,再跑备用链
- 备用链也失败,才真正抛错
如果你有多个备用方案,也可以继续往后排:
1const safeChain = primaryChain.withFallbacks([2backupChain,3finalFallbackChain,4])
4. 顺序很重要:先 retry,再 fallback
这两个工具经常一起用,但顺序不能乱。
更符合预期的写法通常是:
1const safeModel = primaryModel2.withRetry({ stopAfterAttempt: 2 })3.withFallbacks([backupModel])
它表达的是:
- 主模型先重试两次
- 还是失败,再切备用模型
如果顺序反过来:
1const wrong = primaryModel2.withFallbacks([backupModel])3.withRetry({ stopAfterAttempt: 2 })
读起来就不是这个意思了。
所以大多数时候,都优先记成一句话:
先 retry,再 fallback。
5. Parser 失败,也可以单独兜底
还有一类失败,不是模型没回,而是模型回了,但格式不对。
比如你明明要求它只输出 JSON,它却前面多说了一句解释。
这时候模型调用本身是成功的,但 JsonOutputParser 会失败。
最简单的办法有两种:
给 parser 所在链加 retry
1const chain = prompt2.pipe(model)3.pipe(new JsonOutputParser())4.withRetry({ stopAfterAttempt: 2 })
给 parser 准备一个更宽松的 fallback
01import { AIMessage } from '@langchain/core/messages'02import { JsonOutputParser } from '@langchain/core/output_parsers'03import { RunnableLambda } from '@langchain/core/runnables'0405const looseJsonParser = RunnableLambda.from((message: AIMessage | string) => {06const text =07typeof message === 'string'08? message09: typeof message.content === 'string'10? message.content11: message.content12.map((item) => (typeof item === 'string' ? item : JSON.stringify(item)))13.join('\n')1415const match = text.match(/\{[\s\S]*\}/)16if (match) {17return JSON.parse(match[0])18}1920return { emotion: 'unknown', confidence: 0 }21})2223const safeParser = new JsonOutputParser().withFallbacks([looseJsonParser])
这种做法不是为了让结果更漂亮,而是为了让链在格式偶发不稳定时还能继续走下去。
6. 把它接回 Agent:三层容错
这篇真正关键的不是 retry 和 fallback 本身,而是它们在 Agent 链路里该放在哪。
更常见的做法是分三层:
- 前置链失败,要不要给默认值
- 模型失败,要不要切备用模型
- 整条回复链都失败了,要不要给用户一条保底回复
01import { createAgent } from 'langchain'02import { ChatPromptTemplate } from '@langchain/core/prompts'03import { JsonOutputParser, StringOutputParser } from '@langchain/core/output_parsers'04import { RunnableLambda, RunnablePassthrough } from '@langchain/core/runnables'05import { ChatOpenAI } from '@langchain/openai'0607const primaryModel = new ChatOpenAI({08model: 'deepseek-chat',09apiKey: process.env.DEEPSEEK_API_KEY,10configuration: {11baseURL: process.env.DEEPSEEK_BASE_URL ?? 'https://api.deepseek.com/v1',12},13})1415const backupModel = new ChatOpenAI({16model: process.env.DEEPSEEK_MODEL_FALLBACK ?? 'deepseek-chat',17apiKey: process.env.DEEPSEEK_API_KEY,18configuration: {19baseURL: process.env.DEEPSEEK_BASE_URL ?? 'https://api.deepseek.com/v1',20},21})2223// 模型层容错:主模型先 retry,再切到备用模型。24const safeModel = primaryModel25.withRetry({ stopAfterAttempt: 2 })26.withFallbacks([27backupModel.withRetry({ stopAfterAttempt: 2 }),28])2930// 前置分析链:负责给 Agent 补一个 emotion 字段。31const emotionChain = ChatPromptTemplate.fromMessages([32['system', '分析用户情绪,只返回 JSON:{"emotion":"", "confidence":0}'],33['user', '{input}'],34])35.pipe(safeModel)36.pipe(new JsonOutputParser())3738// 如果情绪分析失败,就退到一个最小默认值,别让整条链直接中断。39const safeEmotionChain = emotionChain.withFallbacks([40RunnableLambda.from(() => ({41emotion: 'unknown',42confidence: 0,43})),44])4546// 这条前置链负责保留原始输入,并补 emotion。47const preProcess = RunnablePassthrough.assign({48emotion: safeEmotionChain,49})5051const agent = createAgent({52model: safeModel,53tools: [],54systemPrompt: [55'你是一个前端陪伴助手。',56'如果 emotion 显示用户情绪低落,先共情,再给一个小建议。',57'如果 emotion 不明确,就正常交流,不要编造分析结果。',58].join('\n'),59})6061// 整条链最后的兜底:如果 Agent 回复这一步都失败了,至少返回固定文案。62const finalFallback = RunnableLambda.from(63() => '我现在状态不太稳定,但我还在这里。你刚刚说的内容我已经收到了,等我恢复后会继续陪你。'64)6566async function runAgent(input: string) {67// 第 1 层:先跑前置链,尽量把分析结果补齐。68const preProcessed = await preProcess.invoke({ input })6970// 第 2 层:再把整理后的消息交给 Agent。71const replyChain = RunnableLambda.from(async () => {72const result = await agent.invoke({73messages: [74{75role: 'user',76content: [77`input=${preProcessed.input}`,78`emotion=${JSON.stringify(preProcessed.emotion)}`,79].join('\n'),80},81],82})8384return result.messages.at(-1)?.text ?? ''85})8687// 第 3 层:如果回复链也失败,就落到最后一层固定文案。88return replyChain.withFallbacks([finalFallback]).invoke({})89}9091const reply = await runAgent('今天加班到很晚,有点撑不住了。')9293console.log(reply)
这段代码里,容错层是分开的:
safeModel处理模型抖动safeEmotionChain处理前置分析失败finalFallback处理最后整条回复链失败
这样写的好处是:
不是所有失败都往同一层堆,而是每一层只兜自己那一类问题。
7. 一个简单的判断标准
如果你在想某个失败该放哪一层处理,可以直接按这个顺序判断:
这次失败是不是偶发抖动?
- 是,用
withRetry()
这条路是不是暂时不可靠?
- 是,用
withFallbacks()
这一层失败以后,后面的链还能不能继续?
- 能继续,就给默认值兜住
- 不能继续,就给用户一个最终保底回复
对直接面向用户的回复链来说,最后一层纯函数兜底通常都值得准备。
它不一定聪明,但至少稳定。