返回主题地图

研究论文

产业与政策 · 学术论文与研究进展 · 共 13

8月11日星期二 · 1
量子位研究6

Claude 研究模型突破黎曼猜想纪录,零点比例下界提升至 67.2%

Anthropic 宣布其未公开的 Claude 研究模型在黎曼猜想上取得重大进展,将满足猜想的零点比例下界从 41.6% 提升至 67.2%。该研究由 60 个智能体协作完成,人类仅提供鼓励。结果已通过内部数学家审阅和形式化验证,但未完全解决猜想。

8月10日星期一 · 2
量子位研究3

AI倒查论文100年:99.2%顶刊被检出问题,ICML论文过半无法复现

近期多项研究显示,AI Agent可大规模审计顶会论文的可复现性。ICML 2026的92篇论文中58篇无法复现,GPT-5论文检查系统发现99.2%的顶刊论文存在客观错误。研究者认为AI正开启大规模重审科学文献的新时代,也为学术新人提供了找错、写勘误的新选题方向。

量子位研究3

PDF当死,ARA该立:AI原生科研格式兴起

IEEE Spectrum报道了由斯坦福、密歇根大学等机构研究者提出的ARA(Agent-Native Research Artifact)概念,旨在用机器可操作的知识包取代传统PDF论文,以提升AI对科研内容的理解、复现和延伸能力。实验显示,ARA在理解测试中准确率达93.7%,显著高于传统材料,但存在适用范围窄、隐私安全等问题。该研究由刘嘉晨领衔,已开源

8月9日星期日 · 1
量子位研究1

GPT-5.6与Fable 5联手破解25年MIMO检测难题

微软研究院首席研究员Dimitris Papailiopoulos借助GPT-5.6和Claude Fable 5,证明了一个两步算法能在多项式时间内精确命中MIMO检测的最大似然阈值,解决了悬置25年的数学难题。该算法结合LMMSE取整和贪心逐位翻转,复杂度为O(N³),论文已通过作者逐行验证。

8月8日星期六 · 1
THE DECODER商业1

菲尔兹奖得主加入OpenAI研究AI安全

新晋菲尔兹奖得主、多伦多大学数论学家Jacob Tsimerman加入OpenAI,专注于AI安全研究。他曾发表论文探讨AI可能导致人类灭绝的“omnicide”情景,并认为数学家能为AI安全做出贡献。前DeepMind CEO Demis Hassabis评论称,AI在数学上的进展尚未达到AlphaGo“第37步”那样的根本性突破,但未来可能实现。

8月6日星期四 · 2
Latent Space商业0

DeepMind 四巨头离职创业,Demis 转任董事长

Google DeepMind 发生重大领导层变动,Jeff Dean、Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 四位顶级人才离职,共同创立专注于自动化机器学习和科学研究的公益公司 Discovery Loop,并获得 Alphabet 等投资。Demis Hassabis 转任董事长兼首席科学家,Koray Kavuk

另有 1 家信源报道

THE DECODER商业0

谷歌DeepMind领导层大换血:Hassabis升任首席科学家,Dean离职创业

谷歌DeepMind进行重大领导层调整,联合创始人兼CEO Demis Hassabis卸任日常管理职务,转任Alphabet首席科学家,专注于AGI战略和健康领域;首席科学家Jeff Dean在任职27年后离职,与Sanjay Ghemawat共同创立自动化科研公司Discovery Loop。Koray Kavukcuoglu接任DeepMind高级副总

另有 1 家信源报道

8月3日星期一 · 4
THE DECODER研究0

两个团队用GPT-5.6三小时内解决同一量子密码问题

两个研究团队在三个小时内分别使用OpenAI的GPT-5.6 Sol Ultra解决了同一个量子密码学开放问题,相关论文已提交至arXiv。这两个团队分别来自MIT和加州大学圣塔芭芭拉分校/加州大学洛杉矶分校,他们正在考虑合并论文。这一事件引发了关于AI对独立发现和科研身份影响的讨论。

arXiv cs.MA一手来源研究0

SeekBrain:加速神经科学发现的自主多智能体系统

arXiv 论文介绍了 SeekBrain,一个自主多智能体框架,旨在通过领域基础的层次规划和跨模态数据分析加速神经科学发现。该框架从代码-论文对中动态构建分析配方库,并耦合智能体规划与执行引擎,按需生成假设和分析流程。在 BrainArena 基准上的评估显示其性能优于现有智能体基线,并在斑马鱼和小鼠真实数据中揭示了神经表征结构。

Together AI Blog一手来源开源0

Together AI 发布开源深度研究工具 Open Deep Research

Together AI 发布了 Open Deep Research,一个开源的 LLM 工作流,用于回答需要多跳推理的复杂问题并生成研究报告。该工作流模拟人类研究过程,包括规划、搜索、自我反思和写作,并集成了 Together AI 云平台上的多种模型。其目标是提供灵活、可扩展的架构,供开发者社区使用和扩展,同时发布了数据集和代码。

AI at Meta Blog一手来源研究0

Meta发布Brain2Qwerty v2:非侵入式脑机接口实现实时句子解码

Meta AI 发布了 Brain2Qwerty v2,这是一种无需手术植入即可从非侵入性脑信号中实时解码句子的 AI 系统,词准确率达 61%,最佳参与者达 78%,显著优于其他非侵入方法。Meta 开源了训练代码,合作伙伴 BCBL 发布了数据集,旨在帮助因脑损伤而无法交流的患者,并推动神经科学开放研究。

8月2日星期日 · 1
Simon Willison's Weblog研究0

OpenAI 用 Astra 模型解决十个长期未解数学难题

OpenAI 使用其下一代模型 Astra 的内部版本,在不到 2000 美元(按 GPT-5.6 Sol 代币价格计算)的成本下,解决了十个至少十年未获进展的数学问题。OpenAI 公开了 Lean 4 形式化证明、论文及 LLM 生成的证明重建 PDF,但未透露具体提示词。数学家对此反应不一,有人将其与 Deep Blue 事件类比,数学家 Kirwin

另有 1 家信源报道

4月24日星期五 · 1
One Useful Thing观点

GPT-5.5体验:AI能力持续跃升,但前沿仍不均衡

作者Ethan Mollick提前体验了GPT-5.5,认为其性能显著提升,尤其在编码和图像生成方面,并展示了模型、应用和工具链的进步。他用GPT-5.5 Codex处理自己的学术数据,生成了接近博士二年级水平的论文,表明AI能力仍在快速提升,但前沿能力仍不均衡。