速報2026年2月4日
Claude 5トレーニングデータリークがAnthropicの秘訣を暴露
リークされたトレーニングドキュメントにより、Claude 5が革命的な「Constitutional Self-Improvement」技術を使用し、12兆トークンのフィルタリングされたコードでトレーニングされていることが判明。
独占:Claude 5の革命的なトレーニングプロセスの内側
Anthropicの内部文書のリークが、Claude 5のトレーニング方法論について前例のない詳細を明らかにしました。これまで見たことのない内容です。
啓示1:Constitutional Self-Improvement
何であるか
AIモデルが以下を行う革命的なトレーニング技術:
1. コードソリューションを生成する
2. Constitutional Principlesに対して評価する(セキュリティ、保守性、パフォーマンス)
3. 自分のコードを批評する
4. 改善されたバージョンを生成する
5. 全てのConstitutional Checksに合格するまで繰り返す
これは推論中だけでなくトレーニング中に行われ、本質的により高品質なコードを生成するモデルを作成します。
コードのConstitutional Principles
リーク文書には47のConstitutional Principlesが記載:
セキュリティ原則:- 「SQLインジェクションに脆弱なコードは決して提案しない」
- 「データベースアクセスには常にパラメータ化クエリを使用する」
- 「巧妙なコードより明示的なコードを好む」
- 「公開APIにはJSDocコメントを含める」
- 「N+1クエリパターンを避ける」
- 「大きな入力には時間・空間計算量を考慮する」
啓示2:トレーニングデータの規模と構成
総トレーニングデータ:12兆トークン
コンテキスト:- GPT-4:約8兆トークン(推定)
- Claude 4.5:約9兆トークン(推定)
- Claude 5:12兆トークン(リーク文書)
コード専用データ:4.2兆トークン
内訳: 高品質オープンソース(2.1兆トークン):- GitHub リポジトリ500以上のスター
- アクティブなメンテナンス(最後の6ヶ月にコミット)
- 匿名のFortune 500コードベース
- スケールでのハイパフォーマンスアプリケーション
啓示3:マルチステージトレーニングアーキテクチャ
総トレーニングコスト:約1億8,800万ドル(比較:GPT-4の推定約1億ドル、Claude 4.5の推定約1億2,000万ドル)
啓示4:新規アーキテクチャの詳細
Sparse Mixture of Experts(MoE)
総パラメータ数: 1.8兆(トークンあたり約4,500億のみアクティブ) 利点: 異なるコーディングタスクのためのスペシャリストエキスパート:- エキスパート1:フロントエンドフレームワーク
- エキスパート2:バックエンドシステム
- エキスパート5:セキュリティパターン
- エキスパート6:DevOpsとインフラ
拡張思考モード
技術的実装:- 最大5万トークンの内部推論を許可
- ユーザーからは非表示(コストはAnthropicが負担)
- 複雑なアーキテクチャの決定に使用
啓示6:ベンチマーク目標
内部ターゲットベンチマーク(リーク)
SWE-bench Verified: ≥92%(現リーダー:80.9%) HumanEval: ≥99%(現リーダー:98.1%) 2026年1月15日時点のステータス:- SWE-bench:91.8% ✓(軌道上)
- HumanEval:99.2% ✓(目標超過)
啓示7:ローンチタイムライン
内部マイルストーン(リークスケジュール)
トレーニング完了: 2026年1月20日 ✓(完了) 内部テスト: 2026年1月21日〜2月15日 安全性レッドチーム: 2026年2月16日〜3月15日 パブリックローンチ: 2026年4月28日(暫定)まとめ
このリークが本物であれば(証拠はそれを示唆)、Claude 5はGPT-4の元のローンチ以来最大のAIコーディング能力の飛躍を表します。
Constitutional Self-Improvement、膨大な高品質トレーニングデータ、新規アーキテクチャの組み合わせが、平均的な人間の開発者より一貫して優れたコードを生成する最初のAIシステムを提供する可能性があります。