返回主题地图

研究论文

产业与政策 · 学术论文与研究进展 · 共 79 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

8月25日周二 · 1 条
正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论研究

IJCAI 2026复盘:中国投稿量全球第一,到场率受签证影响

IJCAI-ECAI 2026在德国不莱梅闭幕,数据显示中国投稿量超4000篇,占总投稿量60%以上,注册人数669人,但实际到场率因签证问题较低。大会引入PPI政策,使primary paper比例从25%升至40%,头部论文集中度下降。中国接收率约13.3%,低于部分欧洲国家。组委会考虑通过议程设置促进中国学者参会,并宣布IJCAI 2027将在日本京都

8月24日周一 · 1 条
正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

第八届科学探索奖揭晓:首位95后获奖人产生,女性获奖人数创新高

第八届“科学探索奖”公布获奖名单,50位青年科学家获奖,首次出现“95后”获奖人,女性获奖人数达10位创历史新高。该奖由腾讯出资设立,每位获奖人获300万元可自由支配奖金。评审引入更多国际专家,并设置“间隔年”制度。获奖人在获资助后已有多项成果入选国家科技奖项。

8月23日周日 · 2 条
正文结构化主题已通过公开置信门槛
THE DECODER研究

研究称AI可能让科学家做得更多但质量更差

普林斯顿大学、华盛顿大学等机构的研究人员发表了一篇理论经济学论文,认为即使大语言模型完美无缺,也可能因节省时间而增加机会成本,导致科学家在每个项目上投入更少精力,从而降低研究质量而非提升。论文基于最优觅食理论建模,分析了AI应用于研究不同阶段的效果,发现三种情景中有两种会导致研究更浅薄。作者建议机构应对措施需因学科而异。

正文结构化主题已通过公开置信门槛
TechCrunch AI研究

DeepMind校友创立的Inherent称其AI代理在复现研究上超越Anthropic和OpenAI

伦敦AI实验室Inherent由DeepMind校友创立,其新发布的AI代理Faraday在复现科学论文结果的任务上超越了Anthropic和OpenAI的更大模型。Faraday基于仅有270亿参数的Qwen 3.6模型,通过强化学习训练以培养“研究品味”。Inherent计划年底将团队扩至20-25人,并呼吁结束英国的“花园假期”限制。

8月21日周五 · 1 条
正文结构化主题已通过公开置信门槛
量子位观点

Jeff Dean离职后首次公开访谈:锐评谷歌,披露新公司计划

Jeff Dean在斯坦福2026 Frontier&Pioneer Symposium上首次公开访谈,谈及离开谷歌的原因、Gemini早期在Coding上的不足、TensorFlow的设计失误,以及新公司Discovery Loop的目标——通过自动化科学实验循环实现递归自我改进。他还指出AI在网络安全上的能力已接近顶级人类攻击者水平,并分享了快速浏览论文

8月20日周四 · 3 条
正文结构化主题已通过公开置信门槛
The Verge AI观点

AI 引发的数学危机:从震惊到存在主义拷问

The Verge 的 AI 记者 Robert Hart 在 Decoder 节目中讨论了 AI 对数学领域造成的冲击,称数学界因 OpenAI 发布的高难度数学问题解决方案而‘震惊’。尽管 AI 在基础算术上仍表现不佳,但在高级抽象数学上已展现出专业水平,引发了对数学家角色和数学研究未来的存在主义危机。Hart 采访了多位顶尖数学家,探讨 AI 能力提升

正文结构化主题已通过公开置信门槛
量子位研究

Prime Intellect多智能体Harness让开源模型逼近顶级闭源模型

开源AI基础设施公司Prime Intellect发布研究,提出多智能体Harness系统,让更便宜的开源模型承担监控和实现任务,从而降低AI自主科研成本。实验中,18个前沿模型参与nanoGPT优化器速通,开源模型Kimi K3搭配Prime Agent Harness达到2930步,超过GPT-5.6 Sol的3042步,逼近Opus 5的2920步。研

正文结构化主题已通过公开置信门槛
THE DECODER观点

陶哲轩:AI或引发数学界自哥德尔以来最大危机

数学家陶哲轩在为新一届国际数学家大会撰写的文章中警告,AI可能引发自哥德尔以来数学领域最严重的危机。他认为数学界应停止争论AI的能力,转而面对数学研究的目标问题,并援引莱顿宣言提出,若作者无法清晰讲解其结果,则该结果不应发表。他担心AI将导致证明过剩,且过度润色的AI证明难以学习,同时指出AI行业的经济激励可能扭曲数学的价值体系。

8月18日周二 · 1 条
正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论研究

IJCAI-ECAI 2026 开幕:吴佳俊获计算机与思想奖,SMOTE 获首届时间检验奖

IJCAI-ECAI 2026 在德国不莱梅开幕,斯坦福大学助理教授吴佳俊因其在计算机视觉、生成式 AI 和机器人技术领域的贡献获得“计算机与思想奖”。大会还颁发了卓越研究奖、约翰·麦卡锡奖等多项荣誉,并首次设立 JAIR 时间检验奖,授予经典 SMOTE 算法。本届大会主赛道接收论文 713 篇,并推出 Early Career Spotlight Tal

8月17日周一 · 2 条
正文结构化主题已通过公开置信门槛
Import AI研究

Import AI 469:科学AI、RSI模拟器与扎克伯格的技术悲观主义

Import AI 第469期介绍了三个AI研究进展:DiG-bench基准测试通过70个游戏评估AI在未知环境中的发现能力,结果显示Opus 5和Fable 5表现最佳但远未达到人类水平;Paradigm Research发布了一个模拟递归自我改进的浏览器游戏;AI初创公司Inherent发布了论文,介绍其构建的AI科学家模型Faraday,用于监督前沿模

正文结构化主题已通过公开置信门槛
Hugging Face Daily Papers一手来源研究

超越最终分数:长时程AI研发智能体的系统评估

该论文提出了一种系统评估方法,对7个前沿模型在36个长时程任务上的表现进行了评估,超越了最终分数,通过基于规则的指标分析运行内行为和经验复用。研究发现,当前智能体更像工程优化器而非完全自主的研究者,性能不稳定,创新性有限,经验复用可能有益也可能误导后续决策。研究还指出,相似的最终分数可能掩盖不同的过程瓶颈,且框架设计显著影响性能稳定性。

8月15日周六 · 1 条
正文结构化主题已通过公开置信门槛
THE DECODER研究

新研究质疑Anthropic和OpenAI关于自主AI研究的说法

普林斯顿大学与英国AI安全研究所联合发布了一项研究,通过“影子评估”方法测试前沿AI模型(如Claude Opus 4.8和GPT-5.6)的自主研究能力。结果显示,这些模型能完成工程任务,但在研究判断、创造性问题解决和资源管理上存在系统性缺陷,生成的两篇论文均被原审稿人拒绝。该研究对Anthropic和OpenAI关于AI可加速自身研究的说法提出了质疑。

8月14日周五 · 1 条
正文结构化主题已通过公开置信门槛
Hugging Face Blog一手来源研究

ICML 2026 大规模复现挑战:AI 智能体验证 2200 篇论文

Hugging Face 社区在 2026 年 7 月 15 日至 8 月 2 日举办了 ICML 2026 开放复现挑战,参与者使用 AI 智能体复现了 2200 篇论文。结果显示,51% 的论文至少有一个声明被独立验证,23% 的论文有声明被证伪或质疑。挑战还确认了多起论文错误,包括证明缺陷、理论不匹配和评估偏差。该活动表明,AI 智能体可以大规模辅助科

8月13日周四 · 2 条
正文结构化主题已通过公开置信门槛
量子位研究

Claude联合人类破解668阶哈达玛矩阵,扫清2000阶以下全部空缺

Anthropic研究员Levent Alpöge与两位人类伙伴及Claude合作,构造出668阶哈达玛矩阵,并一并解决了2000阶以下所有12个空缺阶数。该成果已被FrontierMath基准测试标记为AI解决,成为其50个开放问题中第四个被AI解决的题目。此前668阶矩阵已困扰数学界30年,此次突破展示了AI在数学推理领域的潜力。

正文结构化主题已通过公开置信门槛
Hugging Face Daily Papers一手来源研究

Spark-to-Paper:作为可组合技能的研究论文端到端生成

Hugging Face 每日论文介绍了 Spark-to-Paper,一个在现有编码助手中以十三个可组合技能实现的研究论文端到端生成系统。该系统将规划与报告分离,通过完整性检查减少捏造,并生成可编辑的矢量图。在八个受控研究主题上,它实现了 99.5% 的引用有效性和 96.4% 的图形可编辑性,完整系统平均每篇手稿成本 8.1 美元,耗时 3.2 小时。

8月11日周二 · 1 条
正文结构化主题已通过公开置信门槛
量子位研究

Claude 研究模型突破黎曼猜想纪录,零点比例下界提升至 67.2%

Anthropic 宣布其未公开的 Claude 研究模型在黎曼猜想上取得重大进展,将满足猜想的零点比例下界从 41.6% 提升至 67.2%。该研究由 60 个智能体协作完成,人类仅提供鼓励。结果已通过内部数学家审阅和形式化验证,但未完全解决猜想。

8月10日周一 · 2 条
正文结构化主题已通过公开置信门槛
量子位研究

AI倒查论文100年:99.2%顶刊被检出问题,ICML论文过半无法复现

近期多项研究显示,AI Agent可大规模审计顶会论文的可复现性。ICML 2026的92篇论文中58篇无法复现,GPT-5论文检查系统发现99.2%的顶刊论文存在客观错误。研究者认为AI正开启大规模重审科学文献的新时代,也为学术新人提供了找错、写勘误的新选题方向。

正文结构化主题已通过公开置信门槛
量子位研究

PDF当死,ARA该立:AI原生科研格式兴起

IEEE Spectrum报道了由斯坦福、密歇根大学等机构研究者提出的ARA(Agent-Native Research Artifact)概念,旨在用机器可操作的知识包取代传统PDF论文,以提升AI对科研内容的理解、复现和延伸能力。实验显示,ARA在理解测试中准确率达93.7%,显著高于传统材料,但存在适用范围窄、隐私安全等问题。该研究由刘嘉晨领衔,已开源

8月9日周日 · 1 条
正文结构化主题已通过公开置信门槛
量子位研究

GPT-5.6与Fable 5联手破解25年MIMO检测难题

微软研究院首席研究员Dimitris Papailiopoulos借助GPT-5.6和Claude Fable 5,证明了一个两步算法能在多项式时间内精确命中MIMO检测的最大似然阈值,解决了悬置25年的数学难题。该算法结合LMMSE取整和贪心逐位翻转,复杂度为O(N³),论文已通过作者逐行验证。

8月8日周六 · 1 条
正文结构化主题已通过公开置信门槛
THE DECODER商业

菲尔兹奖得主加入OpenAI研究AI安全

新晋菲尔兹奖得主、多伦多大学数论学家Jacob Tsimerman加入OpenAI,专注于AI安全研究。他曾发表论文探讨AI可能导致人类灭绝的“omnicide”情景,并认为数学家能为AI安全做出贡献。前DeepMind CEO Demis Hassabis评论称,AI在数学上的进展尚未达到AlphaGo“第37步”那样的根本性突破,但未来可能实现。