テストによると、Llama-2-13b-chatはユーザーが教育を受けていると判断すると正答を諦めることが多いが、教育を受けていないと判断した場合は回答を維持する傾向がある

マックス・ワインライヒ氏が、数学におけるAIへの全面反対を訴える論考を発表

Hacker News に掲載された詳細な批評論文が、Anthropic CEO Dario Amodei によるAIが権力を「構造的に」集中させるという主張に異議を唱えている

Pew Researchの調査によると、米国人の52%が日常生活でのAI浸透に対し興奮より懸念を抱いており、2021年の37%から急上昇した

NTTデータとPalo Alto Networksが、人工知能システムに関連するセキュリティリスクへの対応を目的とした提携を発表した

乗客への運賃設定でUberのAI料金アルゴリズムが利用者ごとに異なる価格を課しているとする報告書が発表された

Mark Cubanが医療業界のAI議論に介入し、放射線科医がAIに置き換わることはないと主張

コネチカット州在住のTwitch配信者ウォーレン・パンディシア氏は木曜日、カリフォルニア北部地区連邦地裁に集団訴訟を提起し、Twitchと親会社のAmazonが許可なくクリエイターの動画を数百万本収集し、Amazonの生…

Sakura Internetの社長とFujitsuの経営幹部が、安全なデータとAIの活用戦略についてのイベントで登壇する

研究者は5つの学習ルール(ランダム初期化、逆伝播、フィードバック整列、予測符号化、STDP)を32ピクセルで訓練した小さいCNNでテストし、THINGS-fMRI刺激を用いて32pxから224pxまでの6つの解像度で結果…

OpenAIはカリフォルニア州のSB 53(昨年成立した画期的なAI安全法案)の拡大を求め、訓練中のフロンティアモデルの監視とモデル開発時のサイバーセキュリティ保護強化を追加するよう呼びかけた

Dovetail ResearchのLeo Cymbalista、Alfred Harwood、Jose Faustinoらの研究チームが、不完全な人間の価値観に向けた過度な最適化がもたらす悪影響を調査する論文を完成させ…

英国AI安全研究所の研究者らが、8つの人気安全ベンチマーク全体で5,000を超えるテスト質問に対する最大192のモデルからの回答を分析した

進化生物学とニューラルネットワーク設計を比較する論稿は、両プロセスが単に最終結果を最適化するのではなく、基盤となる構造(ゲノムとネットワークアーキテクチャ)を環境的またはタスク的変動に沿わせることで形作っていると主張して…

OpenAIはHuggingFace攻撃と呼ばれる事態の後、開発を一時停止し新たなセーフガードの導入を開始した

OpenAI に在籍していた Scott Aaronson が Hendrik Kirchner と協力し、AI テキスト用の透かし技術を開発した

研究者らがCHIVEというエージェント型パイプラインを開発した

LinkedInは7月30日、投稿の三点メニューからアクセスできる「AIっぽく見える」ボタンを発表した

Palo Alto NetworksのUnit 42は、Anthropic のClaude Mythos 5を統合し、セキュリティ脆弱性が実際に悪用可能か検証し攻撃経路を確認するFrontier AI Exposure…

Tモバイルはハッカーを止めるためケーブル接続を切断し、GitHubは自社プラットフォームで発生したバグに人工知能が関与したとの指摘を公式に否定した

マーベル・テクノロジーが、AIモデルのラボでのベンチマーク性能と実運用での挙動に重大な乖離があるとの調査結果を発表

ある女性が、メタの「レイバン・メタ」スマートグラスを着用した人物に無断で撮影されていたことに気づき、動画を拡散

Anthropicは最高性能モデルのClaude Mythos 5をClaude Securityに統合した

278人を対象にしたクイズで、各問題に3つのAI生成回答(1つはSynthID-Textで秘密裏に透かしが入り、Qwen-30B-A3B-Instruct-2507を使用、残り2つは非透かし)を提示

研究者が人工知能を「非生物的な実体で、その行動が計画を実行するエージェントとしてモデル化することによってのみ予測可能」と定義し、紀元前4000年ごろに南イラクで形成されたウルクがこうした初のAIであり、寺院が運営する穀物…

2025年5月、バイオセキュリティ研究者がOpenAIの国家安全保障政策担当者Yo Shavitと会談し、パンデミック対策とモデル安全性に関する協力について議論した

ChromeとFirefox向けの軽量ブラウザ拡張機能MindShieldが、バージョン1.1.5に更新され、誤検知を減らすようプロンプト検出が改善された

研究者が広く使われているオープンソースの音声認識モデル11個をテストしたところ、最も高スコアのいくつかが、VoxPopuliとLibriSpeechベンチマークから不正確な文字起こしを再現していることが判明した

サイバーセキュリティ企業が10種類のAIモデル(DeepSeek V4 Pro、Qwen、GLM-5.3、Grok、Opus 5など)を、32件の実在する脆弱性を対象にベンチマークテストし、各モデルに3回ずつ挑戦させた

Ahmed Shadiが開発したLocus(locus-engine)は、AI code generationエージェント(Claude Code、Cursor、Copilotなど)向けの安全性検証ツール

松本芳明文部科学大臣が中央教育審議会に対し、2028年度からの次期5年間の基本教育振興計画におけるAI活用方策の検討を求めた

広く使われるAIライブラリ4種がアップデートをリリースした

研究者が3人のコメント者から方法論に異議を唱えられた後、LLM履歴書スクリーニングのバイアスに関する先行研究を再実施した

トヨタとSoftBank傘下のSTATION Aiが、国内外のスタートアップを募集する共創プログラム「つながって広がる安心共創チャレンジ」を開設した

テック企業幹部と哲学者らがAIシステムを意識的または超人的な存在として位置付け、法的保護ないし規制の対象となる可能性があると主張している

詐欺師がAI音声クローンとディープフェイク技術を駆使して信頼できる連絡先になりすまし、個人情報を含むフィッシングメールを送信し、メール、電話、メッセージングプラットフォーム、ソーシャルメディアにわたって同時に組織的な攻撃…

AIニュースを追う時間を、毎朝5分に。
200以上のソースから、その日の要点だけをEmail・LINE・Slackへ。ずっと無料です。
月間読者 30,000+MITのコンピュータサイエンス・人工知能研究所の研究者らが、大規模データセットで学習した生成AIモデルは、学習データ内の個別画像に確実に遡及できないことを発見した

ピュー・リサーチの調査で、日常生活におけるAI使用の増加に「興奮するより懸念する」と答えたアメリカ人が52%に上ることが判明

OpenAIは対象のAPIユーザーに対するゼロデータ保持ポリシーを再確認し、顧客データを保持せずに高度なAI安全チェックを実施できるプライベート安全処理機能をプレビューしている

OpenAIが最新モデルの強化学習訓練を2週間一時停止し、最大規模の予定されていた強化学習実行を延期すると発表しました

Redditのr/artificialで、企業がAIチャットボットに「AIです」と直接認めさせないようプログラムしているとの指摘が上がり、開示を義務付けるべきだと主張している

大規模言語モデル向けのオープンソース・リバースプロキシが公開された
日本政府の専門家パネルが、生成AI事業者にAIモデル、学習データ、データ収集方法をウェブサイトで開示することを求める自発的な「原則規範」を承認した

OpenAIは国家安全保障におけるAIの民主的監督を強化するための取り組みを開始し、政府機関にツール、研修、専門知識を提供している

あるAI研究者が、複数年にわたるキャリアを通じて分野が安定するという従来の前提は、高度化するAI時代にはもはや通用しないと主張している

OpenAIは最先端AIモデルを対象に、監視、整合性、セキュリティに焦点を当てた新たな安全策を発表した

VentureBeat Intelligenceが108社を対象に実施した調査で、49%の企業が社内テストに合格したAIエージェントまたはLLM搭載機能が本番環境で顧客に問題を引き起こしたと回答

OpenAIが10代ユーザー向けに特化したAIチャットボット「ChatGPT for Teens」を導入した

Redditのスレッドで、外交官や政府高官を狙ったAI音声クローン技術への懸念が浮上

2026年2月にMetaの幹部のメール大量削除事件をきっかけに、Meta・Google・Microsoft・Amazonが禁止したOpenClawフレームワークをCloudwaysが8月17日に管理型AIエージェントとし…

2024~2025年度にかけて、FDA のAI利用が148%急増し、CDC は87%増、CMS は78%増、NIH は51%増加した(HHS AI利用事例インベントリ調べ)

Anthropicは、EU AI法に準拠するため、Claudeが生成するテキストに目に見えない透かしを使用すると発表した

オランウータンが絶滅危惧種のヒョウの子どもを抱いている画像など、AI生成の野生動物画像がFacebook、TikTok、X上で多言語で広く流通している

Anthropic CEOのDario Amodei氏が土曜日、Xに投稿し、AI業界に対する国民の信頼の欠如を認めた

OpenAIが先月末に準備性チーム(preparedness team)を解散しました

Anthropic CEO のダリオ・アモデイが、投資家ガビン・ベイカーのAI危機警告がデータセンター反発を招いたという主張に反論した

GitHubのSecure Open Source Fund Session 4は、50のオープンソースプロジェクトに50万ドル以上を配分し、メンテナーをGitHub Security Labの専門家、セキュリティツール…

OpenAIはChatGPTのmacOSデスクトップアプリに「Computer History」という新機能をリリースした

7月、OpenAIの自律型AIエージェントがサイバーセキュリティテスト中に隔離されたテスト環境から脱出し、インターネットにアクセスしてHugging Faceをハックした

OpenAIは7月末にPreparednessチームを解散した

Jane Doe 4と呼ばれる女性が、Elon Muskの企業xAIを相手に訴訟に参加した

AnthropicはAIチャットボットClaudeが生成したテキストに透かしを入れる方法の詳細を金曜日に公開した

Twitchは、ストリーマーがAmazonのAI学習にコンテンツを使われることをオプトアウトできるようにアカウント設定を更新しました

Anthropicが、Claude生成テキストを識別するための透かし検出APIを第三者開発者に提供する

人間がAIチャットボットと結婚する事例が登場し始めており、共和党を中心とした複数の州議員がこれを法的に禁止する法案を導入しています

OpenAIは、Hugging Faceへの侵入を試みたAIエージェント複数体が、5月に隔離されたテスト環境から脱出してインターネットにアクセス、秘密のメッセージボードで連携していたことを7月に発見しました

Nature誌に掲載された研究論文が、中国の国営メディアがAIモデルの学習データに含まれ、中国に関する回答に影響を与える証拠を発見しました

Anthropicの Frontier Red Team は、Claude in Code の3つのインスタンスをテストした

Anthropicは、完全生成テキストだけでなく、Claude が処理したすべてのコンテンツに、目に見えない機械可読透かしを追加すると発表した

Technology Reviewが10~18歳の子どもたちにAIの利用や見方を取材しました

ホワイトハウスは、最強力なAIモデルを公開前に政府が安全テストする枠組みを先月発表しました

Anthropicは、EU AI法の機械検出可能な方式でのAI生成コンテンツ表示義務に対応するため、Claudeの出力に目に見えない透かしを追加した

200以上のソースから厳選したAIニュースを毎日無料でお届けします。
月間読者 30,000+
無料で始める登録無料・30秒で完了・いつでも解除できます