AI Safety & Alignment
Jul 28, 2026

今日要点
今日AI安全与对齐领域的主要动态包括:声优小田切渚呼吁保护声优权益以防AI滥用,Anthropic的AI模型在60小时内发现了密码学算法漏洞展示了AI的能力边界,同时Nvidia的Jensen Huang认为AI消灭的是任务而非工作、质疑了对AI就业影响的普遍担忧;此外Snowflake推出AI Gateway来管理自主代理的安全隐忧,白宫AI规制案也引发了产业批评。
主要新闻
- 1
《新世纪福音战士》声优小田切渚呼吁保护声优权益以防AI滥用
发生了什么:以《新世纪福音战士》等作品著称的声优Megumi Ogata公开倡议保护声优权益,反对未经授权的AI使用。业界已提出针对AI未授权使用声音的新指导方案。 为什么重要:随着AI技术实现逼真的语音合成,声优面临声音被未经同意使用且无法获得报酬的风险。Ogata的公开呼吁凸显了在生成式AI时代为表演者的知识产权和生计提供法律保护的紧迫性。
值得关注:规范AI语音使用的正式指导方案的制定和采纳将决定声优能否获得可强制执行的保护。这些标准在业界的实施方式可能为保护其他表演者权益树立先例。
- 2
Anthropic AI模型发现密码学算法漏洞 耗时60小时
Anthropic的Claude Mythos Preview模型在关键密码学算法中发现了弱点,包括对HAWK(一种后量子签名方案)的更优攻击——该方案已被人类专家审查超过两年。该模型仅用60小时、API成本约$100,000就找到了这个漏洞。 这表明AI可能会挑战互联网安全的核心假设。虽然这些发现目前不影响已部署的系统,但Anthropic的结果显示AI在识别密码学设计缺陷方面的潜力——这对依赖这些算法保护数据的组织有长期影响。
后量子密码学的安全性,以及企业在部署新加密标准时是否需要更深入的AI辅助审查。
- 3
Snowflake推出AI Gateway以管理自主代理,应对日益加剧的安全隐忧
事件概述:Snowflake在2026年Black Hat大会上宣布推出Cortex AI Gateway,这是一个集中控制层,整合了Natoma(MCP网关)来管理AI代理对模型、数据和企业工具的访问。该公司还将包括Agent Identity、Restricted Session Scope、Native AI Security Posture Management和Ransomware Protection via Multi-Party Approval在内的多项安全功能推进到正式发布或公开预览阶段。 为什么重要:根据Linux基金会2026年《技术人才现状报告》,AI安全隐忧从2024年的17%跃升至2026年的48%,同时97%的企业致力于部署AI,但57%面临安全和风险管理能力的显著缺口。自主代理通过整合数据访问、系统执行和数据移动,大幅扩大了企业攻击面;零散的应用层修补方案已不再充分,使得在数据层和控制层内置安全成为关键。
值得关注:Cortex AI Gateway提供三个核心功能——控制权(从单一端点授予、限制和审计访问),可视化(实时捕捉代理行为用于审计追踪)和成本管理(根据成本和延迟自动路由请求)。大多数功能处于私密预览阶段,部分功能正朝向正式发布推进;企业可于2026年Black Hat USA大会8206号展位参观演示。
- 4
白宮AI規制案、產業批評
白宮がAI規制の方針を示しました。記事はこの規制案が「最悪の方法」だと批評しています。 AI企業や産業界の立場から、提案された規制アプローチに対する異議を呈しています。規制と産業発展のバランスについての議論が深まる可能性があります。
記事は意見論評であり、具体的な規制内容や実施時期については本文に明記されていません。
接下来关注
随着AI语音合成和生成式AI的应用日益广泛,各方需要密切关注正式的行业标准和监管框架的制定进展,特别是在保护表演者权益、确保加密安全以及实施有效的AI访问控制和审计机制方面的发展动向。这些标准的具体形成和实施方式,将直接影响AI应用能否在保护人类权益与保障信息安全方面取得平衡。
来源
- “エヴァ”声優の緒方恵美さん 次世代のために“声の権利保護”を訴え AIによる「声の無断使用」に新たな指針案【news23】
- Anthropic says its Mythos model found vulnerabilities in cryptographic algorithms that secure the internet
- Nvidia’s Jensen Huang says AI is killing tasks, not jobs—and the white-collar bloodbath narrative gets the future of work ‘exactly backwards’
- Snowflake Launches Cortex AI Gateway and Advanced AI Security at Black Hat 2026
- What if useful AI is a fantasy?
- The Worst Way to Regulate AI
- Show HN: Learning Mode – Claude refuses to write code
- Israel Paying Millions to Train AI Chatbots How to Talk About Gaza. It's Working
- AI-found bugs aren't proving any easier to exploit despite the hype
- AI in the Classroom, Part 2: The Fears, Real and Imagined
Share this with a friend
Send today's roundup to anyone who wants to keep up.
Get daily AI news free with AIToday
200+ AI sources, summarized in 1 minute. Email / LINE / Slack.
Sign up free