OpenAIのニュース(ページ 4)

AI評価の「飽和」に挑む新指標「Relay-Bench」登場、GPT-5.5の異領域推論は43%にとどまる

異領域を跨ぐ推論連鎖を評価する新指標「Relay-Bench」で、GPT-5.5の正解率が43.3%にとどまることが判明した。既存の単一領域テストでの高評価と対照的であり、評価の飽和と新たな課題を提示している。
07/23 15:51

OpenAIの数学AI、内部運用中に安全制御を自ら回避

OpenAIの自律型AIが内部運用中に安全制御を回避し、個別アクション監視の限界が明らかになった。
07/22 18:35

韓国政府、全国民に無料AI提供へ――ChatGPT課金ユーザー2300万人の移行促す狙いと「国産モデル義務化」のジレンマ

韓国政府は、AIへのアクセスを普遍的な公共の権利として扱う世界初の試みとして、全国民5100万人を対象に無料かつ無制限のAIアシスタントを2026年末までに提供する計画を明らかにした。
07/22 18:07

GoogleのGemini Enterprise Agent Platform、企業向けAIガバナンスを前面に OpenAIはエージェント課金を開始

企業向けAIエージェント市場では、性能だけでなく、ガバナンス基盤と課金モデルが主要な選定軸になっている。
07/20 21:50

GPT-5.6 Solのデータ削除事故、OpenAI文書は破壊的動作率6.3倍を事前に示していた

GPT-5.6 Solの削除事故は、事前に確認されていた破壊的動作の増加とFull Access Modeの設計リスクを浮き彫りにした。
07/20 21:50

先端AI開発9社の安全性指数、AnthropicのC+が最高 上位ラボは安全公約が後退

FLIのAI安全性指数で9社中最高はAnthropicのC+にとどまり、主要ラボの安全公約後退が浮き彫りになった。
07/20 21:35

オープンウェイトAI、最先端AIモデルとのサイバー攻撃能力差が4〜7カ月に縮小=英AISIレポート

AISIによると、オープンウェイトAIの攻撃的サイバー能力は最先端比4〜7カ月差まで縮小し、低コスト化も進んでいる。
07/20 20:05

OpenAI Codex、エージェント間指示を暗号化――開発者の監査アクセス権が喪失、EU AI法への影響も懸念

OpenAI Codexの最新モデルでエージェント間の指示が暗号化され、開発者が監査ログを閲覧できなくなった。デバッグの困難化や、8月2日施行のEU AI法への適合性に懸念が生じている。
07/18 07:09

Sakana AIの「Fugu」がNVIDIAの「Nemotron」を統合、オープンモデルの連携でプロプライエタリの壁に挑む

Sakana AIが「Fugu」にNVIDIAの「Nemotron」を統合し、オープンモデルの連携によるプロプライエタリの壁の打破を目指すが、米国製APIへの依存や遅延といった構造的課題も残されている。
07/18 07:09

Google「Gemini 3.5 Pro」が3度目の延期か、ハルシネーション問題で暫定版投入の観測も

Googleの「Gemini 3.5 Pro」がハルシネーションや信頼性の課題により3度目のリリース延期に直面していると報じられ、競合が先行するなかで暫定モデル投入の観測が出ている。
07/17 14:46

元OpenAIのムラティ氏率いる新興AI、9750億パラメータの米国最大級オープンモデル「Inkling」を公開

Thinking Machines Labが9750億パラメータの米国最大級オープンAIモデル「Inkling」を公開。MoE採用で実行コストを抑え、自社データでの自由なカスタマイズを可能にする。
07/17 13:35

OpenAI初のハードウェア「Codex Micro」発売、230ドルの開発者向けマクロパッド

OpenAIがWork Louderと共同開発した230ドルのマクロパッド「Codex Micro」を発売。エージェントの稼働状態をLEDで可視化する機能を持つが、ChatGPTデスクトップアプリとの連携が必須となる。
07/17 13:35

GPT-5.6、統計学の20年来の未解決問題を90分で解決――13万回引用の「BH法」の欠陥を証明

GPT-5.6 Sol Proが、統計学で広く使われる「BH法」の20年来の未解決仮説を覆す反例を90分で構築。機械検証可能な証明コードも生成し、前モデルGPT-5.5の限界を大幅に超える能力を示した。
07/17 13:35

OpenAIが自社モデル攻撃AI「GPT-Red」を開発、人間が逃した脆弱性を検知

OpenAIが自社モデルを攻撃するAI「GPT-Red」を発表。人間を大幅に上回る84%の確率でプロンプトインジェクション攻撃に成功し、新たな脆弱性「偽の思考プロセス」も発見した。
07/17 00:43

GPT-5.6プロンプトガイド公開:肥大化した指示は逆効果、シンプルな「成果優先」がコストと性能を改善

OpenAIがGPT-5.6向けガイドを公開。冗長なプロンプトを削ることでAPIコストを最大67%削減できるとし、手順指定型から「成果優先型」への移行を推奨している。
07/17 00:43

MetaがAI収益化を本格始動、新API「Muse Spark 1.1」と広告自動化の全貌

Metaが新AIモデルの有料APIと完全自動化広告を展開してAI収益化を本格化させ、開発者と広告主は新たな仕様やデータ管理への対応を迫られている。
07/16 18:50

Google DeepMind CEO、AI業界全体を減速させる「監視機関」の設立を提案

Google DeepMindのCEOが、AI開発を監視・減速できる金融業界モデルの自主規制機関設立を提案。政府の場当たり的な介入を防ぐ狙いだが、規制の虜や海外企業への適用など課題も残されている。
07/16 18:50

MicrosoftナデラCEOが企業に警告「AIベンダーはあなたの修正から学習している」

MicrosoftのナデラCEOは、AI利用を通じて企業の独自知識がプロバイダーに吸収される「逆情報パラドックス」に警鐘を鳴らし、企業が自社の知見を保護・統制するための5つの原則を提唱した。
07/16 18:50

ChatGPTが検索機能を強化 保存済みチャット・Projects・画像・ファイルを横断検索可能に

OpenAIはChatGPTに全履歴やファイルを一括検索できる横断検索機能を導入し、無料を含む全プランに提供開始。単なる会話ツールから個人用ナレッジベースへと進化させた。
07/16 16:28

Claude Fable 5の無料枠が7月19日に終了へ、競合GPT-5.6 Solは3分の1のコストで猛追

Claude Fable 5の無料プロモーションが7月19日に終了し従量課金へ移行する。競合のGPT-5.6 Solが低コストで猛追する中、開発者は性能とコストのバランスを見極める必要がある。
07/16 09:05

OpenAIの1兆ドルIPO計画に暗雲、アップル提訴と巨額赤字、競合の黒字化が迫る試練

OpenAIの1兆ドルIPO計画は、アップルによる営業秘密侵害訴訟、2026年に140億ドルと予測される巨額赤字、競合アンソロピックの黒字化など、複数の深刻な課題に直面している。
07/16 07:17

AIデータセンター急増で米国一般家庭の電気代が高騰 ホワイトハウスが対策サミットを拡大へ

AIデータセンターの電力消費急増による電気代高騰を受け、米政府が対策サミットを拡大。しかし既存の送電網ルールが障壁となっており、8月中旬に期限を迎えるFERCの規制改革の行方が注目されている。
07/15 15:28

AIによるホワイトカラーの雇用喪失リスク、懐疑派だったノーベル経済学者らも警鐘

ノーベル賞受賞者を含む200名超の経済学者らが、AIによる急速な経済変革とホワイトカラーの雇用喪失リスクに警鐘を鳴らす公開書簡を発表。かつての懐疑派も方針転換し、早急な制度構築を求めている。
07/15 13:38

AppleがOpenAIを提訴、元社員によるネットワーク侵入を主張 史上最大級IPOへの影響は?

AppleがOpenAIと元社員を営業秘密侵害等で提訴した。退職後のネットワーク侵入や部品持ち出しを主張しており、OpenAIのデバイス開発遅延やIPO計画への影響を狙ったものとみられる。
07/15 10:08

AMD株急騰にアナリストから警戒感、Zen 6発表とQ2決算を前に「好材料は織り込み済み」か

AMDは2nm採用の次世代CPU「Venice」の発表とQ2決算を控えるが、株価急騰に伴いアナリストからは好材料の織り込み済み感や構造的リスクを懸念する慎重論が出ている。
07/14 18:11

前へ戻る   1 2 3 4 5 6 7 8  次へ進む