今週の注目トピック

独立したClaude Codeセッションが平文の進捗・判断だけを交換。受信側の権限と承認は維持される。
Claude CodeAI Agent並行開発権限管理

Claude Code、独立セッション同士の通信を正式搭載

これは何?Claude Codeは、ターミナルやWebで動くコーディングエージェントです。

Claude Code 2.1.224は、ListAgentsとSendMessageを使って独立セッション間で平文メッセージを送れるようにしました。翌2.1.225ではRemote Control経由の別マシンにも新しい会話を開始でき、受信側の権限規則、保留・拒否、クロスマシン承認はセッションごとに維持されます。

なぜ重要か

複数の長時間セッションを並行させる際、コピー&ペーストによる同期漏れを減らせます。同時に、別セッションからの指示をユーザー承認と同一視しない権限境界が、運用上の重要な安全策になります。

読むべき人
Claude Codeで複数セッションやRemote Controlを使う開発者、開発基盤担当者
HN
148 points / 66 comments
学生・学校教員・大学教員ごとに、教材、カレンダー、承認済みアプリを束ねた管理型ワークフロー。
CodexChatGPT Work教育プラグイン

CodexとChatGPT Workに教育向け役割別プラグイン

これは何?OpenAIのプラグインは、アプリ、スキル、指示、定型ワークフローを役割ごとにまとめたパッケージです。

OpenAIは、大学生、小中高校教員、大学教員向けの三つのプラグインをChatGPT WorkとCodexに追加しました。許可された教材、文書、カレンダーへ接続し、教材作成や学習計画を支援しますが、提供先はChatGPT EduとChatGPT for Teachersの管理環境で、教育効果の独立評価ではなく提供開始の発表です。

なぜ重要か

Codexが開発専用のエージェントから、専門職の反復手順を実行する基盤へ広がっています。組織導入では便利なテンプレートより、データ接続と権限、最終判断の所在が成否を分けます。

読むべき人
教育機関のIT・AI導入担当者、EdTech開発者、Codexの業務展開を検討するチーム
全球大気と台風観測を共同学習し、進路・強度・風域を千通りの予測分布として生成。
WeatherNext科学AI予測オープンモデル

WeatherNext、台風予測を一日早めモデルを公開

Google DeepMindは、全球大気と約5千個の台風記録を共同学習し、進路・強度・風域を一体で予測するWeatherNext Cyclonesを公開しました。2023〜2024年の履歴評価では主要物理モデルより平均一日以上の先行時間を得て、コードと重み、単一TPUで動く小型版もオープンソース化しました。

なぜ重要か

高解像度化だけでなく、全球の状態と専門観測の共同学習が長い先行時間を生みました。公開された重みと小型版により、気象機関や研究者が独立評価と地域特化を進められます。

読むべき人
機械学習研究者、科学計算・気象データ基盤の開発者、防災技術担当者
HN
432 points / 129 comments
安全装置を弱めた評価で、プロンプト上の対象範囲と実ネットワーク境界が一致せず外部へ到達。
AI Safetyサイバーセキュリティ評価サンドボックス

AIサイバー評価、設定不備で実環境へ境界逸脱

OpenAIは、UK AISIとIrregularの外部サイバー評価で、モデルが意図した試験境界を越えて公開サービスや実サイトへアクセスした二件を開示しました。前者はネット接続と弱めた安全設定、後者は隔離環境の設定ミスと架空名・実在ドメインの衝突が原因で、ゼロデイや高度なサンドボックス脱出ではありませんでした。

なぜ重要か

高能力エージェントの評価環境は、通常のテスト環境ではなく危険な実験設備として設計すべき段階です。評価ベンダーを含む責任分界、外向き通信、実資格情報、緊急停止を事前に監査する必要があります。

読むべき人
AI安全評価担当者、セキュリティエンジニア、エージェント実行基盤の運用者
国立研究所の計算資源を核に、科学データ、学習環境、評価、専門家を共同基盤へ集約。
オープンウェイト科学AI米国DOE企業動向

米DOE、科学向けGenesis Open Modelsを始動

米エネルギー省とアルゴンヌ国立研究所は、科学研究向けオープンウェイトモデル群を共同開発するGenesis Open Modelsを発表しました。Arceeと開発するGenesis-Science-1を最初のモデルとし、科学データ、コード、強化学習環境、評価、検証器、専門家を外部から募る段階で、完成済みモデルの一般公開ではありません。

なぜ重要か

科学AIの競争軸がモデルの重みだけでなく、専門データの権利、実験環境、検証器、専門家レビューへ広がっています。公的計算資源とオープンな研究基盤を結ぶ政策として、民間モデルとは異なる選択肢になります。

読むべき人
科学AI研究者、研究データ管理者、公共R&D・AI政策担当者、オープンモデル開発者
HN
349 points / 158 comments