跳到正文

← 博客

新版发布

Chimera Agent 0.49.3:修复实际使用中的问题,而非仅文档描述

经过真实场景测试后修复的六个缺陷,包括静默写入失败、误导性测试结果和过时的模型默认值。

我们自己写的、关于我们某个版本的文字。 在 GitHub 上阅读这条 release →

当工具伪造自身状态时

最昂贵的教训来自MCP数据读取。一个消耗5.11美元的任务因拒绝消息未区分人工拒绝与系统无法批准而产出零文件。用户直到三次相同尝试耗尽预算才意识到重试无效。现在每种拒绝情况都会自解释:人工拒绝显示操作者,系统拒绝标明配置块,HTTP情况则明确声明无审批人存在,同时建议两种解决方案——启用暂停审批或避免非信任内容。

失效的验证机制

当后续写入操作修改文件后,带有通过测试日志的verified: True标识变得毫无意义。用户看到绿色对勾时实际操作的却是未验证内容。系统现在追踪交付文件是否匹配验证状态,并在出现偏差时显示警告标识。原始验证结果仍可见(它当时是准确的),但当前的不匹配状态会并列显示。

失效的默认值

模型分配已出现危险偏移:

  • 主模型成本是当前选项的4倍
  • 预览模型占据了关键默认槽位
  • 上下文窗口达不到层级要求

新默认值符合当前性价比(deepseek-v4-flash-0731成本仅为1/4)同时保持能力。.env.example文件不再推荐已停用模型或过时价格。值得注意的是,模型选择并非基于输出质量测试(八位候选者均成功生成文件),而是可量化因素:价格、上下文窗口和第三方基准。

升级建议

立即更新如果您使用:

  • MCP服务器(测试行为已变更)
  • 文件验证(新增差异检测)
  • 模型默认值(显著成本/性能变化)

完整技术说明阐述每个修复的决策依据:Chimera Agent v0.49.3

https://chimeraagent.space