
AI Agent 工具调用死循环怎么停:重复检测、错误分类与熔断
先阻止下一次不安全工具调用,再用执行上限、真实进展、操作台账和不可自行重开的终态收口;响应丢失时先核对业务结果,再决定恢复。

先阻止下一次不安全工具调用,再用执行上限、真实进展、操作台账和不可自行重开的终态收口;响应丢失时先核对业务结果,再决定恢复。

system 角色被拒绝,先查最终请求走的是 Anthropic Messages、Chat Completions 还是 Responses。初始指令、对话中追加的指令和工具结果各有对应字段与位置;修好结构后,还要验证指令约束和完整任务。

Cyber Abuse 邮件先分清是警告还是停用:警告时账号仍可用,先导出数据;停用后只申诉一次,写清授权范围和当时任务,登不上走 Privacy Portal,退款按扣费渠道查。

已有 Anthropic API Key,就设置 ANTHROPIC_API_KEY 并在交互模式批准使用;已有企业网关,就按其认证方式配置地址和凭据。settings 文件可能覆盖终端变量,模型与 VS Code、Desktop 入口还需分别设置。

长会话跑偏、跨会话丢规则和 Context7 查不到文档,需要修复不同环节。先确认窗口占用与规则加载,再按实际安装方式检查连接和认证。

通过 OpenRouter 用 DeepSeek,配置 OpenRouter 密钥与 deepseek/deepseek-v4.1-flash;直接请求 DeepSeek,使用其 Anthropic 端点与 deepseek-flash。主模型和辅助角色要分别设置,成功回复后还需核对实际模型与用量。

top_p deprecated 不表示 Opus 模型已经退役。先找到最终请求中的旧采样字段:原生 Messages 用 top_p,Bedrock Converse 用 inferenceConfig.topP;省略正确位置的参数后,再验证同一任务是否恢复。

Claude Sonnet 5.5 与 Sonnet 5 单价相同。按第三方分档测试,low 到 xhigh 每任务更省,max 档贵约五成;改模型 ID 前先查五项破坏性变更。

Claude 提示无法认证不是封号:Temporarily unable to authenticate 有事故就别登出,Login expired 等本机报错才重新登录。

Codex 令牌交换 403 没有通用的一键修复:保留完整错误后缀,回调不通时选设备码或 SSH,地区与工作区拒绝时核对资格和权限,最后在原环境验证原认证方式。

已有录音用 gemini-3.5-transcribe,实时音频用 gemini-3.5-transcribe-live。预录的词表与说话人、逐词时间戳不能同时开启;实时字幕要分别处理临时和最终结果,并在音频结束后限时收尾。

官方 Batch 把 Gemini 3 Pro Image 相应费率降为标准的一半,适合提前准备的图片任务。1K/2K 图片输出标价为 0.067 美元,但预算还需计入输入、思考与重试;提交后保存任务名,按请求键回收图片。

截至 2026 年 10 月 6 日,只有 GPT-6.1 Sol 能调用,Astra 版已取消;Gemini 4 Argon 仅限 Fairwind,Fable 5.5 是传闻。

GPT-6.1 Sol 标价同 GPT-6 Sol,仅缓存输入减半至 $0.10;推理强度改 low,工具调用改走 Responses。国内可经老张API调用,缓存命中按全价计费。

在每次付费调用前,将已结算费用、在途预留和本次费用上界一起检查;额度不足立即停,账单未知继续占用额度。附不连接供应商的可运行预算闸门示例。

截至 2026 年 10 月 6 日,Nano Banana 2.1 未官宣,没有 API 和价格,Flow 里短暂出现后被报告撤回;上线项目先用 Nano Banana 2。

Nano Banana 2 返回 503 时,先确认接口和 HTTP 状态,再在次数与总耗时预算内退避重试;预算耗尽就暂停或排队,收到图片数据并完成解码才算出图成功。

Gemini 中选了 Pro,不代表第一张图就由 Nano Banana Pro 生成。先检查“更多 → 使用 Pro 重做”、资格与额度;开发者则核对稳定模型和实际图片。原请求失败的原因要看反馈,不能只凭一个成功对照判断。

遇到 Unsupported file URI type,先检查图片字段实际发出的值:它应是当前接口支持的单一引用,而不是本地路径、未展开表达式或数组。原生 Gemini 已支持符合条件的 HTTPS 图片地址,也可使用原始 base64 或上传返回 URI。

遇到 openai.APIConnectionError: Connection error,先在报错进程或容器里检查 DNS、TLS、代理和实际 API 地址,再按 Python、Node 的版本配置超时与客户端。用底层异常区分修复方向,用原业务请求确认恢复;没有 request ID 不代表请求未被处理。

OpenAI API 提示 quota exceeded 或 insufficient_quota 时,先看 error.code:余额耗尽要补充额度,组织或项目支出超限要调整对应硬限制,获批用量用尽要申请提额。充值后仍失败,还要核对到账状态和请求所属组织、项目。

Assistants API 已于 2026 年 8 月 26 日停用。现在要从应用保存的配置和记录迁出:恢复可用历史,重新管理状态与工具调用,再把流量切到经过验证的 Responses 实现。故障退路也必须在新系统中成立。

只交付文字时,先算转写和必要的后处理;需要语音回应时,再比较 Realtime、GPTLive 与 STT→LLM→TTS 的完整费用。通话分钟、双方音频分钟和会话活跃秒数不能混用,便宜与否要落到完成同一任务的总成本上。

对比2026年最佳AI视频模型,包括Sora 2、Veo 3.1、Runway Gen-4.5、Kling 2.6和开源方案。提供经过验证的定价数据、每10秒视频的真实成本计算、基于场景的推荐方案以及API开发者指南。