Anthropic CEO称AI反弹是信任危机,否认警告过度负面
Anthropic CEO Dario Amodei回应投资者Gavin Baker的批评,否认其AI风险警告导致公众反弹,认为AI负面看法本质上是信任危机,源于公众对科技行业的不信任。他承认AI公司未兑现造福世界的承诺,并反驳了监管等于权力集中的简化观点,强调Anthropic的政策提案旨在限制前沿AI公司而有利于小竞争者。
产业与政策 · 法规、合规要求与政府动作 · 共 225 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Anthropic CEO Dario Amodei回应投资者Gavin Baker的批评,否认其AI风险警告导致公众反弹,认为AI负面看法本质上是信任危机,源于公众对科技行业的不信任。他承认AI公司未兑现造福世界的承诺,并反驳了监管等于权力集中的简化观点,强调Anthropic的政策提案旨在限制前沿AI公司而有利于小竞争者。
AWS 开源了 Dogwood,一种用于治理智能体工具调用序列的策略语言。Dogwood 扩展了 Cedar,支持基于事件历史的时序条件,并已集成到 AgentCore Policy 中。该语言以 Apache 2.0 许可发布,但 AWS 警告其参考解释器仅用于探索,不适用于生产环境。
这篇立场论文认为,现代AI对齐方法虽然旨在防止有害输出,但具有双重用途,可能被恶意行为者滥用于审查和操纵。作者通过将当前对齐技术映射到可能的滥用案例,指出追求“完美对齐”的模型无意中为信息控制提供了工具,并呼吁社区讨论这一风险,提出缓解策略。
IAPS研究员Severin Field采访了来自OpenAI、Anthropic、Google DeepMind、Meta及美国高校的25名研究人员,探讨递归自我改进(RSI)风险。多数受访者认为自动化AI研究是严重且紧迫的风险,并指出METR的Task Horizon基准显示AI任务时长每6个月翻倍。自访谈以来,多个里程碑已被实现,如OpenAI和Dee
Anthropic 为遵守欧盟《人工智能法案》透明度规范,对 Claude 输出添加隐形水印。此举引发部分用户不满,认为会暴露其使用 AI 的行为,但多数网友表示支持,认为水印有助于识别 AI 生成内容。
在拉斯维加斯Ai4大会上,Geoffrey Hinton、李飞飞和吴恩达三位AI先驱就开源AI的安全性展开讨论。他们一致认为应保持AI开放,但就开放权重模型的风险存在分歧:Hinton担忧其被滥用,但承认开放已成定局;吴恩达强调开放对美国竞争力的重要性;李飞飞则主张开放与封闭应分层结合。三人均支持适度监管。
Solv Labs 在 Amazon Bedrock AgentCore payments 上构建了可验证、可审计的 AI 代理支付工作流,结合 ORACLE 策略引擎和 ICME PreFlight 合规验证,确保每笔交易在四秒内完成预授权、治理和链上结算,并生成完整审计轨迹。该方案利用 AWS Nitro Enclave 进行硬件级完整性证明,支持独立验
Simon Willison 在其博客中引用了 Sophie Alpert 关于工程师使用 AI 写作的内部政策,强调自然语言文本不存在无损转换,任何改写都会改变原意。政策要求工程师对文档中的每个想法和句子负责,不能将 AI 生成的内容推卸责任。该观点旨在确保文档真实反映作者思想,避免信息丢失。
Spotify 宣布将开始为 AI 生成的艺术家资料添加“AI Persona”标签,并禁止其音乐进入编辑和算法推荐。该标签将于 9 月中旬上线,Spotify 将主动审查高收听量的资料,并允许艺术家自我申报。此举旨在平衡 AI 创新与防止低质量 AI 内容泛滥,同时保护用户体验。
Anthropic计划于9月或10月进行IPO,估值达9650亿美元,这将成为AI行业估值的基准。在初步投资者会议中,投资者对中国廉价AI模型的竞争、与特朗普政府的政治紧张关系以及数据中心建设的阻力表示担忧。Anthropic淡化中国竞争,强调其专注于顶级模型,并计划通过健康与生物学应用来应对负面情绪。此次IPO的定价和上市后表现将影响整个AI行业的估值。
Anthropic 宣布将对其 AI 模型(包括 Claude)生成的文本添加水印,以遵守欧盟《人工智能法案》的透明度规范。该水印基于 C2PA 标准,会在文本复制粘贴时保留,并适用于所有 Claude 产品。此举是 AI 行业应对监管和用户反弹的一部分,其他公司如 OpenAI、Google 等也已承诺遵守该规范。
Meta 在扎克伯格发表个人超级智能文章一周年之际,发布了开放权重模型 Muse Glimmer,并计划推出 Spark,标志着其重返开放权重前沿。扎克伯格在文章中阐述了 Meta 以个人超级智能为核心的战略,并提出了关于就业、基础设施、安全、美国领导力等风险与应对建议。Glimmer 模型可在单张 RTX 3090 上运行,被视为美国开放模型的一次胜利。
Anthropic宣布将在新款Claude模型中嵌入隐形文本水印,并签署欧盟AI法案透明度准则,该机制适用于2026年8月2日后发布的所有模型,全球推行。水印作为文本一部分,复制粘贴和编辑后仍可能保留,同时为支持的文件类型添加C2PA元数据。此举引发网友争议,但Anthropic称不影响生成质量,并计划提供检测工具。
Meta CEO 马克·扎克伯格发布长篇宣言《未来属于每个人》,阐述其对超级智能 AI 发展的愿景,包括推动数据中心建设、开放 AI 模型、呼吁减少政府监管但加强网络安全合作。该宣言旨在塑造 Meta 作为负责任 AI 领导者的形象,并影响公众和政策制定者。
Meta 发布了 30B 参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可,可在消费级 GPU 上本地运行,并在多数基准测试中优于同类竞品。扎克伯格同时发表文章,捍卫模型蒸馏的合法性,并呼吁美国在开放模型领域保持领先。Meta 计划未来几周发布更强模型 Muse Spark 1.2 的开放权重版本,并考虑通过云业务变现其数据中心
另有 2 家信源报道
本期 Import AI 468 报道了 IFP 智库提出的 23 项应对 AI 研发自动化(RSI)风险的政策建议,涵盖透明度、风险管理和国际合作等七类。MIT 和哥伦比亚大学的研究《Racing to Ruin》通过博弈论分析指出,信任与透明度是 AI 企业实现协调减速的关键变量。此外,还包含一篇关于未来 AI 交互的科幻短篇故事。
该研究提出一个动态多智能体框架,将政府投资、家庭居住选择、房价、人口流动和学校质量联系起来,用于分析公共教育投资的长期影响。政府规划者使用强化学习(RL)制定多年期分配政策,在模拟中该政策实现了最高的教育可及性(0.4780)和较低的公平性指标(基尼系数0.0164),优于其他基线。结果表明该框架能减少教育机会的社会经济分层,支持长期政策分析。
Anthropic 于 2026 年 6 月 9 日发布 Claude Fable 5 和 Claude Mythos 5 模型,随后因美国商务部出口管制于 6 月 12 日暂停访问,6 月 30 日管制解除后于 7 月 1 日恢复。Claude Opus 5 的系统提示词中加入了相关说明,以确保模型在回答关于此事件的问题时提供准确、客观的信息。
新墨西哥州法院裁定 Meta 因社交媒体危害和成瘾问题支付 5.67 亿美元罚款,加上此前 3 月的 3.75 亿美元,总额达 9.42 亿美元。法院还要求 Meta 移除点赞计数、限制未成年人使用时长和推送通知。Meta 表示将上诉,州总检察长称该判决追究了公司责任。
软银在1月向特朗普总统图书馆捐赠5000万美元,数月后宣布租赁联邦土地在俄亥俄州建设大型AI数据中心。参议员沃伦等质疑此举涉嫌贿赂,指出软银在特朗普任内捐赠且图书馆尚未建立,而此前对里根和小布什图书馆的捐赠均在其卸任后。软银回应称捐赠用于支持图书馆建设与运营。