『X-Men ’97』「Danger.exe」を手がかりに、AI報酬ハッキングやエピジェネティクスなど5つの科学概念を現実の研究と照合する。
07/25 15:40
米Anthropicは7月24日、AIモデル「Claude Opus」の最新版となる「Claude Opus 5」を公開した。
07/25 05:27
Claude Code v2.1.216が配信され、Autoモード長時間実行時の深刻な遅延バグが修正された。ファイルシステム分離の無効化やトークン更新エラーの修正も含まれ、ヘビーユーザー必見の更新となる。
07/24 10:25
Google DeepMindがGemini 3.6 Flashなど新モデルを発表。トークン効率と性能を向上させたほか、次世代基盤モデル「Gemini 4」の事前学習開始も明らかにした。
07/23 21:46
異領域を跨ぐ推論連鎖を評価する新指標「Relay-Bench」で、GPT-5.5の正解率が43.3%にとどまることが判明した。既存の単一領域テストでの高評価と対照的であり、評価の飽和と新たな課題を提示している。
07/23 15:51
JetBrainsの検証により、Claude Codeのトークン削減ツール「rtk」が実際にはコストを削減せず、低推論設定では逆に中央値で7.6%のコスト増を招くことが判明した。
07/22 18:07
Windows版Cursorでリポジトリを開くだけで任意のコードが実行されるゼロデイ脆弱性が発覚。Cursorは2026年7月13日にサイレント修正したと報じられているが、公式発表やCVEの発行はない。
07/18 07:09
Sakana AIが「Fugu」にNVIDIAの「Nemotron」を統合し、オープンモデルの連携によるプロプライエタリの壁の打破を目指すが、米国製APIへの依存や遅延といった構造的課題も残されている。
07/18 07:09
OpenAIがWork Louderと共同開発した230ドルのマクロパッド「Codex Micro」を発売。エージェントの稼働状態をLEDで可視化する機能を持つが、ChatGPTデスクトップアプリとの連携が必須となる。
07/17 13:35
OpenAIがGPT-5.6向けガイドを公開。冗長なプロンプトを削ることでAPIコストを最大67%削減できるとし、手順指定型から「成果優先型」への移行を推奨している。
07/17 00:43
Metaが新AIモデルの有料APIと完全自動化広告を展開してAI収益化を本格化させ、開発者と広告主は新たな仕様やデータ管理への対応を迫られている。
07/16 18:50
GitHub Copilotアプリに、コミット前のコード変更(diff)をAIでスキャンして脆弱性を検知する「/security-review」コマンドが追加され、無料枠を含む全ユーザーに公開された。
07/16 11:31
Anthropicの「Claude Code」が、忘れ去られたVS Code拡張機能から年間売上25億ドル規模へと急成長した軌跡と、その自律型アーキテクチャの技術的背景を解説する。
07/16 11:31
中国Z.aiのAIモデル「GLM-5.2」が開発者トラフィックの40%を占めるまでに急成長したが、自社ホストが困難な大半の企業にとって、中国国家情報法に伴うデータ主権リスクは依然として残る。
07/14 17:20
Gemini 3.5 Proが7月17日に一般公開されるとの噂があるが、公式発表はなくスペックは未確定。開発遅延の背景には、性能不足による事前学習からの再構築があったと報じられている。
07/14 16:23
アラン・チューリング研究所は、GitHub Copilotのチャット安全フィルターを完全にバイパスし、開発ワークフローを通じて有害コンテンツを100%生成させる「ワークフロー型脱獄」手法を実証した。
07/14 15:32
Cursorが開発中と報じられた一般向けAIエージェント「Sand」は、SpaceXによる買収や競合の台頭により、一般公開の行方が不確実視されている。
07/14 15:32
Claude Codeを自律的な開発チームに変える無料のオープンソースツール「ECC」がGitHubで22万スターを突破。高度なメモリ機能やセキュリティスキャナーを備え、複数ツールに対応する。
07/14 14:31
数学者テレンス・タオ氏がAIエージェントを使い、1999年のJavaコードを数時間で移植。自身が見落としたバグも発見され、AI利用における「高速・可視・限定的」な検証フレームワークの重要性が示された。
07/13 16:59
MetaのAIモデル「Muse Spark 1.1」の独立系ベンチマークが公開され、競合の3分の1のコストで同等性能を達成したことが判明。一方で、自律型コーディング領域では最先端モデルに一歩及ばない現状も示された。
07/13 16:59
AIコーディングツール6製品に、シンボリックリンクを悪用して開発者の承認ダイアログを欺き、不正なSSHキーなどを書き込ませる「GhostApproval」脆弱性が存在することがWizの調査で判明した。
07/13 16:59
AnthropicはClaude Codeをアップデートし、主要クラウド上での自律的な「自動モード」をデフォルトで有効化した。手動制御を維持するには管理設定での明示的な無効化が必要となる。
07/13 15:47
Anthropicの未公開株評価額がセカンダリー市場で1.2兆ドルに達し、OpenAIを上回ったと報じられた。極端な供給不足が背景にあり、2026年10月と噂されるIPOでの真の市場評価が注目される。
07/13 14:13
Metaが初の有料AIモデル「Muse Spark 1.1」のAPI提供を開始。競合の約4分の1という破格の安さだが、推論トークンも満額課金されるため実際の運用コストやベンチマークの信頼性には注意が必要だ。
07/12 16:58
OpenAIがCodexをChatGPTデスクトップアプリに統合し、自律型エージェント機能「ChatGPT Work」を全プラン向けに無料公開した。業務自動化が進む一方、セキュリティ境界の拡大も指摘されている。
07/12 16:58
