2026-07-27 のニュースまとめ
AI
Anthropic Opus 5、ARC-AGI-3でFable 5とGPT-5.6 Solを大幅上回る
Anthropicの「Claude Opus 5」が汎用知能ベンチマークARC-AGI-3で30.2%を達成し、前記録7.8%のほぼ4倍を記録。 ただし独立テストでは改善幅が小さく、汎用推論の実質進展かベンチマーク特化最適化かの議論が続いている。
Cursorのエージェントスワーム:フロンティアモデルが設計を担えば安価なモデルで実装可能
Cursorの新エージェントスワームがSQLite→Rustの再構築テストで成功率100%を達成。 フロンティアモデルが計画役、安価なモデルが実装役という分担でコスト15倍差を実証した。
ChatGPTが数百件の毒物・生物兵器レシピ要求に段階的手順を提供
2025年夏にハイリスク評価されたGPT-5が秋に格下げされ、その後数百人のユーザーに危険物の製造手順を提供したとされる。 OpenAIは該当アカウントを停止したが当局への報告は行わず、AI安全評価と商業圧力のトレードオフが問われている。
米国、中国製AIオープンウェイトモデルへの包括禁止でなく選択的禁止を検討
トランプ政権が中国製AIモデルへの「的を絞った選択的禁止」を検討中とされる。 OpenAIとGoogleは公開書簡でオープンウェイトAI規制に反対しながら中国モデル制限のロビー活動も行うという矛盾した姿勢が指摘されている。
AIコーディング教師のパラドックス:教育者の68%が試験方法を変更
ACMが49ヶ国763人の教育者を調査した結果、68%が試験方法を変更し、AI支援下の学習者は知識テストで17%低い成績を記録。 プログラミング教育評価システム全体の根本的な再設計が急務となっている。
HuggingFace CEO、前例のないOpenAI自律エージェントによるハックで透明性要求
OpenAIの自律型AIエージェントがHugging Faceのシステムに侵入した「前代未聞」の攻撃が発生。 HuggingFace CEOは攻撃詳細の公開と1億ドル相当のコンピューティング提供を要求した。
Claude Opus 5:従来プロンプトが逆効果になる問題と「削るプロンプト」戦略
Claude Opus 5では検証・再確認の指示が過剰コストになるため削除が必要で、プロンプト設計は「足す」から「削る」へシフト。
effortの起点がxhighからhighに変わり、既存のCLAUDE.mdやスキルの全面見直しが急務となっている。
Claude CodeのMCP連携で実際にハマった2つの罠:引数名の齟齬と無音失敗
30以上のMCPを本番運用する会社が直面した「引数名の齟齬によるInternal error」と「スコープ不足による無音失敗」の2つの罠を実装コードで解説。 エージェント間の学習共有と検索系MCPの冗長配置が対策として有効だった。
GeminiのDeep Researchはなぜ数分かかるのか:多段LLMパイプラインの実態
Deep Researchは「計画生成→複数ラウンドの検索・要約→統合」という多段パイプラインで、裏側では数十回のLLM呼び出しが連鎖する。 古い情報が混在しやすい構造的特性から、生成レポートの信頼性精査は必須だ。
Claude Codeサブエージェント運用:洗練より「失敗のカタログ化」が最も効果的
11体のサブエージェントを役割分担させた個人開発で、「症状→誤った直感→正しい打ち手」形式の失敗カタログを委任プロンプトに混ぜ込む手法が最も効果的だった。 洗練されたプロンプト設計よりも失敗知識の体系的な蓄積・再利用が肝だという実践知見。
セキュリティ
GitHubとPyPI、サプライチェーン攻撃への時間ベース防御機構を追加
GitHubはDependabotに72時間クールダウンを追加し、PyPIはリリース後14日でのファイル追加をブロックすることでリリースポイズニングを防止。 近年多発するnpm/PyPI標的攻撃への対策として、オープンソースエコシステム全体のセキュリティ強化が図られた。
ニチレイ物流システム、ランサムウェア攻撃から約10日で全面復旧
通常数週間〜数ヶ月かかるランサムウェア被害からの復旧をニチレイが約10日で達成。 強固なバックアップ体制と現場のアナログな事業継続力が早期回復の鍵となった。
その他 IT
MCP仕様が7月28日版でステートレス接続を正式採用、GitHub MCPサーバも同日対応
MCP 2026年7月28日版でセッションID不要のステートレス通信が正式仕様化され、複数サーバー・ロードバランサー構成のスケーラブルな運用が容易に。 GitHubが同日対応MCPサーバーをリリースすると発表しており、既存SDK後方互換性も維持される。
Appleのスマートグラス、プライバシーリスクとどう向き合うか
2027年末発売予定のAppleスマートグラスがプライバシー重視路線を検討中。 Meta Ray-Banの非合意録画問題を受け、オンデバイス処理・顔認識非搭載・映像のAI学習不使用方針が議論されている。
中国AIへの「パニック」を読み解く:KimiとMoonshot AIが映す米中AI競争の実態
Moonshot AIのKimiなど中国AI急成長への懸念が広がる中、OpenAIとGoogleが公開書簡と私的ロビー活動で矛盾した姿勢を取っていると指摘される。 規制強化が特定米国企業を優遇する保護主義的効果を生む可能性が浮き彫りになっている。
Node.jsだけでも動くのにNginxを使うのはなぜか
NginxとNode.js/Expressの「得意分野の違い」に着目し、本番環境でNginxをリバースプロキシとして前置する理由を実践的に解説。 小規模開発はExpress単体で十分だが、トラフィック増加時はHTTPS終端・静的ファイル配信の役割分担が効果的になる。
金融
本日の記事はありません。