多くの頭脳、ひとつの答え
ライオン、ヤギ、ドラゴン、ヘビは、主張になるより前からロゴにいました。複数のモデルが答え、審判が一致点と相違点を名指しし、統合器が最終的な答えを書く — ただし、それに見合うだけ難しい問いのときだけです。フュージョン自体は珍しくありません。コストを見るルーターの後ろでエージェントのループに組み込み、それを測ることが違いです。
三つの賭けと、その現在地
適応度シグナルを伴う進化
他のエージェントは起きたことを追記して「学習」します。Chimera は、検証済みの結果がその変更は役に立ったと示したときだけ、学んだ変更を保持します — 判断材料は作業ツリーの実際の差分と正直な A/B であり、モデルの自己申告ではありません。その蓄積が新しいタスクで実際に効くかどうかは測定されており、現時点の答えは証拠ページにあります。
アーキテクチャとしてのセキュリティ
プロンプトインジェクションは広く「パッチ不能」とみなされ、多くのエージェントはアプリ層で緩和するか、対象外と宣言します。ここには本物の防御層があります — 逐語的な参照による汚染追跡であって真のデータフローではなく(汚染されたテキストを言い換えるモデルは、それを洗浄してしまいます)、信頼できない内容からの制御トークン除去、汚染された実行の残りにおける危険なツールの制限、副作用のある再試行の保護。これは任意で、--taint で有効にし、既定では無効です。ドキュメントのセキュリティのページは、各層がどこで止まるかを述べ、なお通り抜けるものを名指しします。
負けた分も含めて公開するベンチマーク
公開するすべての数値に信頼区間が付き、何も出なかった実行もそのまま公開され、再現に耐えなくなった主張は撤回されます。このサイトの数値は手打ちされていません。プロダクトがリリースごとに刻むスナップショットから読み出され、区間は証拠ページにあります。
実際に測られていること
二つのプロダクト
来歴のあるスキルのライブラリ
繰り返し現れる種類のタスクに、エージェントがどう取り組むかを示す短いカードです — コードではなくデータであり、ここにあるものが実行されることはありません。枚数は少なく、その一枚ずつに名前があります。マージ前にメンテナーのレビューを受け、そのページの正確なバイト列のハッシュとともに提供され、あなたの言語で読めます — 原文からずれた訳文は、もう存在しない文を言い換えるのではなく英語に戻ります。
アルファ版であり、そう明言しています
堅実でよくテストされていますが、本番環境で鍛えられてはいません。インストーラーは認証局の署名を持たないため、Windows と macOS は初回起動時に警告します。この警告はダウンロードページのボタンより上にあり、alpha の注記はページの最後にあります。
