跳到正文

← 博客

新版发布

Chimera Agent 0.49.3:针对实际使用场景的修复

版本 0.49.3 解决了在实际使用中发现的关键问题,提升了清晰度、可靠性和成本效益。

我们自己写的、关于我们某个版本的文字。 在 GitHub 上阅读这条 release →

MCP 文件写入问题:清晰度与成本

本次发布中最具影响力的修复之一是关于 MCP 文件写入的高成本问题。此前,通过 MCP 读取数据时,运行会中断且不写入文件,错误信息也含糊不清。这导致重复尝试,每次都会产生成本却没有任何进展。例如,同一任务的四次运行花费了 5.11 美元,但未生成任何文件,而使用内置工具的相同任务在第一次尝试时就成功了,仅花费 0.37 美元。

现在,错误信息会区分三种情况:人为拒绝、配置拒绝和缺少审批者。它还提供了可行的解决方案,例如使用暂停等待审批的开关或避免在运行中使用不受信任的内容。这一变化防止了不必要的重试,降低了成本。

MCP 测试按钮:反馈改进

另一项重要改进是 MCP 测试按钮。此前,它仅确认服务器连接性,误导用户认为代理可以使用该服务器。实际上,代理无法访问服务器,因为默认情况下启动时未加载 MCP 服务器。这导致了时间和资源的浪费,例如在一个案例中,在十九分钟内进行了二十二次工具调用,但未使用服务器。

现在,测试按钮会反馈代理是否可以使用服务器,并为不同原因提供不同的消息。这确保用户了解启用服务器使用的必要步骤。

验证状态:准确表示

此前,verified 状态表示即时验证,但未考虑验证后的变化。这导致在执行相同命令时,针对结果树的运行产生了 20 次失败中的 20 次。现在,状态包括 delivered_matches_verified,并且在磁盘上的文件不再匹配验证状态时,运行列表会显示一个徽章。这为运行结果提供了更清晰的视图。

技能安装:正确的错误信息

此前,技能安装失败会错误地归咎于错误的限制,建议重试或设置 GITHUB_TOKEN,而问题与此无关。现在,令牌会到达两个主机,错误信息会准确识别拒绝的主机。这防止了不必要的重试,并确保用户采取正确的行动。

文件写入:清晰的拒绝信息

此前,文件写入拒绝信息不清晰,尤其是在将绝对路径声明为写入区域时。现在,拒绝信息会命名正在比较的路径,将区域解释为工作区相对路径的 glob 列表,并指出永远无法匹配的模式。这防止了重复的重试和环境故障报告。

模型默认值:更新与可靠性

模型默认值已更新以反映当前版本,确保更好的性能和成本效益。默认模型从 deepseek-chat-v3.1 更改为 deepseek-v4-flash-0731,显著降低了成本。顶级模型更新为 z-ai/glm-5.3,融合判断和面板模型也进行了更新。现在有一个测试确保没有默认模型是 -preview 版本,因为供应商可能会在未通知的情况下撤回这些版本。

详情请参阅 Chimera Agent v0.49.3。

https://chimeraagent.space