メインコンテンツへスキップ
← ブログに戻る
開発ログ2026年4月1日by K.hirano

Anthropicリーク2連発:Claude MythosとClaude Code流出で見えたKAIROS、BUDDY、Undercover Modeの正体

Anthropicの2週間で2回のリークを整理。Claude Mythosの位置づけ、Claude Code流出の中身、KAIROS/BUDDY/Undercover Modeの意味を分けて読む。

#Anthropic#Claude#Claude Code#リーク#AI開発
  • 3/26の「Claude Mythos」と、3/31のClaude Code流出は別件です。ここを混ぜると読み違えます。
  • Claude Mythos側は、次世代Claudeのモデル階層や位置づけが見えた話。
  • Claude Code流出側では、KAIROS / autoDream / BUDDY / Undercover Mode という内部名が話題になりました。
  • ただし、これらの説明は報道・リークの範囲推測がかなり混ざっています。断定はまだ危険です。
  • 実務では、正式発表で何が本当に使えるようになるかを見てから判断するのがいちばん堅いです。

関連記事としては Claude Code の新effortモード徹底解説|max・ultracode・autoと『呪文ultrathink』の正体BlogClaude Code の新effortモード徹底解説|max・ultracode・autoと『呪文ultrathink』の正体Claude Code の /effort に増えた max・ultracode・auto と、プロンプトに紛れ込ませる呪文 ultrathink を、公式が明言した『ultracode は API の effort レベルではない』を起点に解剖。overthinking・自律ワークフロー・永続性と優先順位の罠まで、誤解されやすい論点を一次情報で正します。 もあわせて読むと、今回の論点とのつながりを把握しやすくなります。

目次

これ、たしかに気になります。
Anthropicが短期間に2回リーク絡みで話題になったとなれば、Claudeを追っている人が反応するのは自然です。

ただ、こういう話は見出しが派手なぶん、中身がすぐ混ざります。
報道、リーク元の主張、そこからの推測が、同じ温度で流通しやすいからです。

なのでこの記事では、そこをきっちり分けます。

結論を先に言うと、今回見えてくるのは、Anthropicが次のClaudeで単純な高性能化だけではなく、エージェント化・長時間処理・運用の自動化に寄せているかもしれない、という方向性です。
ただし、ここで言えるのはあくまで方向性まで。性能や提供形態を断定する段階ではありません。

まず整理:2つのリークは別物です

ここを混ぜると、かなり話が崩れます。

リーク1(3/26)リーク2(3/31)
何が流出したか未発表モデルの名称・性能位置づけClaude Code ソースコード ~512,000行
原因CMS(コンテンツ管理)設定ミスnpmパッケージの .npmignore 設定漏れ
判明した内容次世代モデル「Claude Mythos」、Capybara ティアKAIROS / autoDream / BUDDY / Undercover Mode
正式確認状況Anthropicが「step change」と認めたが詳細未公開「manual error」と説明。誰もクビにならず

リーク1:3/26の「Claude Mythos」

こちらは、次世代Claudeの一部とみられるモデル名・ティア名・性能位置づけが話題になったものです。中心にあるのは Claude Mythos、そしてその下位ティアとされる Capybara です。

このリークから読めるのは、Anthropicが次のClaudeを「単体の置き換え」ではなく、用途別の階層構造で出そうとしている可能性です。

リーク2:3/31のClaude Codeソースコード流出

こちらは別件です。Claude Codeの大きなコードベースが流出したとされ、そこから未公開機能や内部プロジェクト名が見えてきた、という話です。

拡散の過程で 512,000行という数字も出ましたが、ここは数字だけで価値判断しないほうがいいです。重要なのは、そこにどんな機能や設計意図が埋まっていたかです。

何が事実で、何が報道で、何が推測か

この記事では、次の3層で分けます。

1. 事実として扱うもの

  • AnthropicがClaude関連の製品・ドキュメントを継続的に公開していること
  • Claude Codeが実在するプロダクトであること
  • 2026-04-01 時点で、今回のリーク内容の多くは正式発表では未確認であること

2. 報道・観測として扱うもの

  • 3/26に「Claude Mythos」と「Capybara」が話題になったこと
  • 3/31にClaude Codeの流出が広く拡散したこと
  • KAIROS / autoDream / BUDDY / Undercover Mode という名称がリーク文脈で出てきたこと

3. 推測として扱うもの

  • Claude Mythosが次世代の最上位候補だという見立て
  • KAIROSやBUDDYがエージェント実行基盤に関わるという解釈
  • Undercover Modeが裏実行や表示制御に関係するのでは、という解釈
  • 2026年中に段階的な投入があるかもしれない、という予測

この区別を崩さないことが、今回いちばん大事です。

Claude Mythosは「次の最上位」候補だが、性能断定はまだ早い

Claude Mythosの話でまず気になるのは、結局どれくらい強いのか、ですよね。

リークベースで語られている範囲では、Claude Mythosは次世代の上位モデル候補として扱われ、Capybaraティアはその下位にあたる位置づけです。ここで重要なのは、Anthropicが単純に「全部盛りの1本」を出すというより、性能・コスト・用途の違う層を分ける方向に見えることです。

これは実務上かなり意味があります。現場では「最高性能」よりも、

  • どのタスクまで任せられるか
  • どこで失敗しやすいか
  • どの速度・価格なら常用できるか

のほうが効くからです。

リークをそのまま受け取るなら、Claude Mythosは“ベンチマークで強いだけ”ではなく、より長い文脈、より複雑な推論、より実務寄りの運用を狙っているように見えます。
ただし、実測値は未確認です。ここで断言するのはまだ危ないです。

では、何を見れば判断しやすいか

Claude Mythosを追うなら、次の観点が重要です。

  • 実ベンチマークの公開有無
  • 長文コンテキストでの安定性
  • ツール使用時の破綻しにくさ
  • コード・文章・推論のどこに強みが寄るか
  • 価格が既存モデルとどう分かれるか

逆に、現時点で「神モデル確定」と扱うのは早いです。

Claude Code流出で見えたのは、機能名より「作りたい未来」です

こちらが今回の本題に近いです。Claude Codeの流出で注目されたのは、ソースコードの量そのものより、未公開機能の名前と、そこから見える設計の方向でした。

1. KAIROS

リーク文脈では、KAIROSは長時間の自律実行や、段階的なタスク処理を支える枠組みとして読まれています。

要するに、1回の応答で終わるのではなく、

  • 途中経過を持つ
  • タスクを分割する
  • 状況に応じて次の手を選ぶ

といった、エージェント寄りの動きに関係している可能性がある、という話です。

ここはエンジニア視点だとかなり重要です。モデル単体の賢さより、途中で迷子にならない仕組みのほうが、実運用では効くからです。

2. autoDream

名前だけだとかなり抽象的ですが、リークの文脈では、バックグラウンドでの内部処理・準備フェーズ・課題分解を連想させます。

ただしここは慎重に扱うべきです。autoDreamという名前から「勝手に学習する」「自己進化する」みたいな話に飛ぶのは早い。
そこまで断定できる材料はありません。

読める範囲では、むしろ

  • 事前整理
  • 課題の分解
  • 実行前の補助処理

のような、地味だけれど効く設計に見えます。

3. BUDDY

BUDDYは、Claude Codeの補助エージェント、あるいは協調実行の相棒として読まれています。

この系統の機能は、現場ではかなり意味があります。1つのモデルに全部やらせると、責任範囲が曖昧になって、失敗したときに原因が見えにくいからです。

もしBUDDYがこの方向なら、Anthropicは「1つの大きな頭脳」より、役割分担する作りを目指している可能性があります。

4. Undercover Mode

これが一番名前のインパクトがありますが、センセーショナルに読むべきではありません。

Undercover Modeは、名前からすると目立たずに動くモード、あるいは人間への露出を抑えた実行モードとして解釈されています。セキュリティ強化を連想する人もいますが、ここも飛びすぎないほうがいいです。

現時点で見えているのは、せいぜい

  • 表示や通知の抑制
  • 裏での作業継続
  • 環境に応じた挙動の切り替え

あたりまでです。

「ステルスで何でもできる」みたいな話ではない、という点は押さえておきたいです。

2週間で2度リークしたことの読み方

ここは「何が漏れたか」より、「Anthropicが何を目指していそうか」を読むパートです。

今回のリークを並べて見ると、Anthropicは次の方向へ進んでいるように見えます。

1. モデルを単体で売るだけではなく、階層化する

Claude Mythos と Capybara の関係が示すのは、用途別・価格別・性能別の整理です。

2. Claude Codeを「コード補助」から「作業実行基盤」に寄せる

KAIROSやBUDDYが示すのは、単なる補完ではなく、複数ステップの実行を持たせる方向です。

3. 長時間タスクに耐える設計を強める

autoDream が想像されている系統なら、裏での準備や継続処理を重視している可能性があります。

4. 人間の前に出す情報をコントロールする

Undercover Mode が示すのは、処理を派手に見せることより、必要な時だけ前に出る設計です。

この流れは、今のAI開発ではかなり自然です。モデルの賢さ競争だけでは差がつきにくいので、次は「どう運用できるか」が差になります。

2026年リリース予測はできるが、断言はまだ危ない

ここがいちばん気になる人も多いはずです。いつ出るのか。

結論から言うと、2026年に向けた段階的な投入予測は十分ありえます。
ただし、これは予測です。公式発表ではありません。

リーク情報をつなぐと、

  • まず内部検証
  • その後、限定公開や一部機能先行
  • 最後に本格展開

という順が自然です。

なので、2026年に何かが見えてくる可能性はある。
ただ、Mythosがそのまま公開されるのか、別名で出るのか、機能が分割されるのかは未確定です。

実務では、日付の当てっこに乗りすぎないことが大事です。見るべきなのは名称よりも、

  • 何ができるようになるか
  • 既存のClaude Code運用がどう変わるか
  • 乗り換えコストに見合うか

です。

いま実務で見るべき判断材料

Claude Codeを使っている人、あるいは次世代Claudeを追っている人が今見るべき点は、だいたい3つです。

1. Claude Mythosが「速いだけ」か「壊れにくい」か

実務では後者が大事です。速くても途中で崩れるなら、結局手直しが増えます。

2. Claude Codeが本当にエージェント寄りに進むか

KAIROS / BUDDY が実体を伴うなら、Claude Codeは「補助」から「半自動の作業相棒」へ寄ります。ここは使い方が変わるので、見逃せません。

3. Undercover Modeが運用にどう効くか

もし裏での継続実行や通知制御が強くなるなら、長時間タスクや夜間バッチ的な使い方との相性が出ます。

読者別の次アクション

エンジニア

  • Claude Codeの現行ワークフローを棚卸しする
  • 「補助で十分な処理」と「自律実行が欲しい処理」を分ける
  • モデル名ではなく、タスク成功率・再実行率・監視コストで比較する
  • 将来のAPI変更に備えて、依存箇所を薄くしておく

非エンジニア

  • まずは正式発表待ちでOKです
  • いま使っているAIツールの置き換え判断を急がない
  • 名前より「自分の仕事がどれだけ楽になるか」で見る
  • もしClaude Code系を触るなら、無理に深追いせず概要把握で十分です

管理職・プロダクト責任者

  • リークを採用判断の根拠にしない
  • ただし、エージェント化の流れは要ウォッチ
  • PoCの評価軸を「回答品質」だけでなく「運用安定性」に広げる
  • 社内説明では、確定情報と未確定情報を必ず分ける

逆に、今はまだ追いすぎなくていい人もいる

今回のリークは面白いですが、全員に必要ではありません。

  • 既存のAIチャットをたまに使うだけの人
  • CLIやエージェント実行に興味がない人
  • 「次のモデル名」が分かれば十分な人

このあたりは、今すぐ深追いしなくても困りません。

一方で、

  • Claude Codeを仕事で触っている
  • AIエージェントの実用度を見ている
  • 次世代Claudeの価格帯と役割分担に関心がある

人は、今回のリークを「単なるゴシップ」で終わらせないほうがいいです。

今はここまで、という整理

Anthropicの2週間で2度のリークは、派手に見えて、実はかなり一貫しています。

  • Claude Mythos は、次世代Claudeの上位モデル候補としての輪郭が見えた話
  • Claude Codeの流出 は、KAIROS / autoDream / BUDDY / Undercover Mode という名前から、Claude Codeを「作業実行基盤」に寄せている可能性が見えた話

そして、2026年について言えるのは、段階的なリリース予測は立つが、断定はまだ早い、というところまでです。

大事なのは、名前に興奮することではなく、次のClaudeがどの場面で効くのか、今の運用を置き換えるのか補強するのかを見極めることです。

注意点・制約

  • 報道ベースの情報が中心で、正式発表ベースでは未確認の部分があります。
  • API仕様や提供条件は、正式公開まで変わる可能性があります。
  • 社内説明や導入判断では、リーク情報だけを根拠にしないほうが安全です。
  • 機能名は出ていても、実際の提供形態や権限設計は別物である可能性があります。
  • この記事では、事実・報道・推測を分けて書いていますが、今後の正式発表で前提が更新されるかもしれません。

どう検証したか

今回は、単にリーク記事をなぞるのではなく、**「一次ソースに近いものから順に、どこまで言えるか」**で整理しました。

検証の順番

  1. 公式情報を先に確認

    • AnthropicのNews / Documentationで、正式に公開されている製品名・説明・更新履歴を確認。
    • ここで「確定情報」の土台を先に作りました。
  2. 3/26のClaude Mythos関連を別枠で整理

    • モデル名、ティア名、性能の位置づけが出ているものを抽出。
    • それが「公式発表」なのか「報道・リークの伝聞」なのかを分けました。
  3. 3/31のClaude Code流出を別枠で整理

    • 流出の対象、流出とされるコード量、内部名の列挙を切り分け。
    • そのうえで、KAIROS / autoDream / BUDDY / Undercover Mode の記述を、実装断定ではなく”解釈可能な兆候”として扱いました。
  4. 資料同士を突き合わせた

    • 公式ドキュメント:既存のClaude / Claude Codeの公開仕様
    • 報道・観測:リーク時に報じられた名称と説明
    • そこから見える共通点:エージェント化、長時間処理、運用補助
    • ここで初めて、実務上の意味に落とし込みました

この記事で避けたこと

  • 「名前が出た=機能が確定」とは書かない
  • 1つのリークから全体像を決め打ちしない
  • 3/26と3/31の話を混ぜない
  • 未確認の実測値や提供時期を断定しない

FAQ

報道されているモデル・機能はもう使えるの?

現時点では、正式公開済みとして確認できる情報は限定的です。公開済みモデルを前提に判断するのが安全です。

KAIROS / BUDDY / Undercover Mode は何ですか?

現時点では、リーク文脈で出てきた内部名・機能名として扱うのが妥当です。役割の解釈はできますが、正式仕様としては未確認です。

Claude Mythos は Claude の次世代モデルですか?

そう読まれていますが、正式発表前なので断言はできません。少なくとも「次世代候補」として見るのが無難です。

2026年に出ると考えていいですか?

「その可能性はある」くらいが適切です。日付の断定は避けたほうがいいです。

リーク情報は無視すべきですか?

無視ではなく、正式発表と同列に扱わないことが大事です。先読みの補助材料として読むのが実務向きです。

参考リンク

公式

リーク報道(一次情報)

追加で確認したい場合

  • 3/26のClaude Mythos関連は、報道元の原文と引用元を突き合わせる
  • 3/31のClaude Code流出は、リーク元の説明と、そこから派生した解釈を分けて読む
  • 公式発表が出たら、まずモデル名・機能名・提供条件の3点だけ比較する

補足: 本記事は 2026-04-01 時点で公開確認できる情報を基準に整理しています。未公開情報やリーク情報は、正式発表で前提が変わる可能性があります。
重要: 報道ベースの未確認情報を含みます。導入判断や社内説明では、正式発表済みの情報と分けて扱うのが安全です。

関連記事

この記事を書いた人

HW系エンジニアとして20年以上、10,000件を超える顧客訪問と2,000件を超える単独ソリューション実績。AIツールを使った個人開発やIoT農園など、Raspberry Piを使ったオートメーション化なども実践中です!エンジニア専門結婚相談所も運営中、ClaudeCodeで解決できない心の課題も解決いたします!

結論、DGX SparkとRTX Sparkは性能でなくOSで選ぶ——2つのSparkの違い
NEW
2026年9月6日
チュートリアル

結論、DGX SparkとRTX Sparkは性能でなくOSで選ぶ——2つのSparkの違い

DGX SparkとRTX Sparkの共通仕様と違いを、OS・形態・時期・用途で整理。実機未検証の範囲も明記します。

#DGX Spark#RTX Spark#NVIDIA#ローカルLLM#AI開発
Claude Codeを10時間放置で実測:177k再読は空ターン何回分か
2026年9月3日
開発ログ

Claude Codeを10時間放置で実測:177k再読は空ターン何回分か

約10時間放置したセッションの再開で 177k トークンが再書き込みされた実測を起点に、Claude Code で1時間キャッシュを空ターンで温め続ける価値を API 単価とサブスク枠の両面から損益分岐で計算しました。

#Claude Code#Claude#Anthropic#LLM#コスト削減
effort を途中で変えるとキャッシュはどうなる? Fable 5.1 と Opus 5 で実測した
2026年9月3日
開発ログ

effort を途中で変えるとキャッシュはどうなる? Fable 5.1 と Opus 5 で実測した

Fable 5.1 の値下げはキャッシュ読みだけ。Claude Code が TTL を決める仕組み、キャッシュを壊す操作と壊さない操作、effort 切替時の再書き込みを Fable 5.1 と Opus 5 の usage で実測しました。

#Claude Code#Claude#Anthropic#LLM#コスト削減
Fable 5.1 は『low で旧 max 超え』なのか|公式グラフ5枚をベンチ別に正直に読む
2026年9月3日
開発ログ

Fable 5.1 は『low で旧 max 超え』なのか|公式グラフ5枚をベンチ別に正直に読む

Claude Fable 5.1 の公式グラフ5枚をベンチ別に読み、low が旧 Fable 5 の max を超えたベンチと超えなかったベンチを表にしました。常用 effort の決め方と Pro/Max の課金条件も整理します。

#Claude#Claude Code#Anthropic#LLM#ベンチマーク

META-MARK × AI

ローカルAIを動かすGPU、ちゃんと選べていますか?

VRAM・性能・コスパをMetaScoreで数値化。AIアプリ別の推奨ハードウェア要件も確認できます。