25位菲尔兹奖得主联名警告AI暴力解题危害数学精神
陶哲轩、邓煜等25位菲尔兹奖得主联合发布紧急声明,指出AI公司以benchmark为导向推进数学研究的方式与数学共同体目标出现严重错位。声明核心担忧包括AI解题速度超过数学界消化知识的速度、商业评价体系与学术评价体系分叉、以及数学研究优先权和人才培养规则需重新制定。导火索是OpenAI用1万个Agent运行88小时宣称解决Navier-Stokes问题,引发
另有 1 家信源报道
公司与模型 · Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 19:03
陶哲轩、邓煜等25位菲尔兹奖得主联合发布紧急声明,指出AI公司以benchmark为导向推进数学研究的方式与数学共同体目标出现严重错位。声明核心担忧包括AI解题速度超过数学界消化知识的速度、商业评价体系与学术评价体系分叉、以及数学研究优先权和人才培养规则需重新制定。导火索是OpenAI用1万个Agent运行88小时宣称解决Navier-Stokes问题,引发
另有 1 家信源报道
Y Combinator CEO Garry Tan 在接受 CNBC 和 TechCrunch 采访时表示,美国不应监管中国 AI 实验室通过蒸馏技术从前沿模型获取知识的行为,反而主张美国小型开源权重 AI 实验室也应获准对美国前沿 AI 实验室进行蒸馏。他认为限制客户对闭源模型 API 的使用是一种过度干预,并指出专有 AI 实验室在训练时也曾未经许可使
OpenAI 发布 Agents API 公开测试版,允许开发者构建可运行数小时、执行代码并处理文件的云端智能体,其底层基础设施与 Codex 和 ChatGPT 相同。该 API 具备自动上下文管理、并行工具调用和子智能体任务委派等能力,开发者可选择 OpenAI 托管沙箱或 Cloudflare、Vercel、Oracle 等合作方,且不额外收费,仅按
另有 1 家信源报道
n8n 发布 2.38.7 版本,主要包含三项核心缺陷修复:让 MCP 工具包成员能在 worker 上执行、访客在流程中途认证后复用已有同意授权、以及为源码管理 HTTPS 远程仓库信任来自 GIT SSL CAINFO 的 CA 证书。该版本为常规补丁更新,提升了 MCP 相关功能与安全配置的稳定性。
阿里云于9月11日升级Token Plan个人版,在价格和Credit额度不变的情况下,为Standard和Pro套餐新增Agent Harness工具权益,覆盖搜索、网页解析、图像生成、语音处理、代码执行等12项Agent开发能力,均通过MCP标准协议开放。同时新增视频生成、Managed Agent托管智能体、RAG知识库、Memory记忆库与Sandb
LiteLLM 发布 v1.102.0-dev.2 开发版本,该版本所有 Docker 镜像均使用 cosign 签名,并提供了基于固定 commit hash 和 release tag 两种验证方式。本次更新包含大量修复与功能改进,涉及 MCP 代理日志与授权、消费追踪、流式响应构建、Azure AI 定价、护栏策略、路由 TTFT 百分位、hosted
《纽约时报》追访披露OpenAI与纽约大学数学家Tristan Buckmaster围绕纳维-斯托克斯方程证明的争议细节,包括OpenAI更新用户数据说法、提出多种合作方案但要求排除Anthropic员工Levent Alpöge。OpenAI随后宣布在另一道千禧年难题上取得实质性进展,传闻指向霍奇猜想,可能由内部代号Aeon的模型完成。事件反映OpenAI
另有 1 家信源报道
Hugging Face 博客介绍了一种针对 GGUF 量化的逐张量布局映射方法。作者利用 Claude Code 在 Framework 提供的 AMD AI Max+ 395 128GB 桌面上运行约 96 小时,对 Qwen3.5-0.8B 和 Qwen3.5-4B 等模型进行了 1000 多次量化实验,通过 degrade-one 和 upgrade
Quarkus LangChain4j 发布 1.14.0.CR3 版本,主要包含依赖升级、Bedrock 可配置提示缓存 TTL 支持、MCP 扩展脱离 LangChain4j 的 Jackson 类型 API、SSE 订阅器空值防护等改动,并回滚了 agentic Dev UI 监控填充 Topology 和 Executions 的功能。新贡献者 @a
蚂蚁数科在2026外滩大会见解论坛上推出Agentar金融版,提供开箱即用的金融智能体专家团、行业Skill、MCP、智能体评测工具及治理能力,帮助金融机构打造覆盖开发、部署、协作、评测与管理的智能体超级工厂。首批预置十大金融智能体专家团,覆盖智能投顾、财富管理、客户经营等场景,并已在银行、证券、保险等机构真实场景验证。蚂蚁数科称已联合合作伙伴在金融场景打造
Ramp 发布的 2026 年 9 月 AI Index 显示,美国 AI 支出最高的企业 8 月人均 AI 支出中位数下降 9.7% 至 7205 美元。Ramp 首席经济学家 Ara Kharazian 认为部分下降源于 8 月工程师休假等季节性因素,同时代币价格下跌和向更便宜模型的迁移也在压低支出。每百万代币有效价格自 2026 年 3 月峰值已下跌
普林斯顿大学人工智能创新中心主任王梦迪在2026外滩大会主论坛上指出,大模型虽掌握大量人类知识,但在科学发现上仍存在明显局限,倾向于高估最常见情况、低估长尾分布。她与谢宇合作的大模型"模拟人生"实验显示,模型在结婚年龄、职业、性别等问题上明显低估少数情况。她认为AI在数学、Coding领域进展迅速是因为有明确验证器,而物理、化学、生物等基础科学缺乏这种验证机
数学家Tristan Buckmaster指控OpenAI在纳维-斯托克斯方程千年难题研究中存在学术不端,包括使用其草稿、施压及排斥其在Anthropic工作的合著者。OpenAI CEO Sam Altman和研究员Sébastien Bubeck否认抄袭指控,但承认在听闻Anthropic可能解决该问题后专门训练了模型。数学家陶哲轩警告,科技公司可能仅凭
MERIT 基准测试评估了工具使用型 LLM 代理中长期记忆的边际效用,通过 23,440 个带成本核算的片段发现,记忆可将依赖任务的成功率从 0 提升至 0.55-1.00,但嵌入检索在更新事实时表现不稳定,而结构化事实存储和 LLM 摘要等更新时写入的记忆更稳健。研究还表明,记忆实现的选择可导致任务成功率相差 60 个百分点,且完整重放不经济。该基准、测
OpenAI 使用未发布的模型解决了纳维-斯托克斯存在性与光滑性问题,这是七个千禧年大奖难题之一,奖金100万美元。NYU教授Tristan Buckmaster指控OpenAI在得知他和Anthropic同事Levent Alpöge的类似工作后才启动项目,存在抢先发表嫌疑。OpenAI否认访问用户数据,但承认无法排除去标识化数据对模型改进的影响。该事件引
另有 1 家信源报道
数学家 Tristan Buckmaster 指控 OpenAI 在得知其与 Levent Alpöge 使用 AI 模型在纳维-斯托克斯方程上取得突破后,施压要求将 Anthropic 联合作者 Alpöge 从论文中除名,并威胁其职业生涯。OpenAI 否认指控,称其独立完成了相关证明,并提议联合发布。OpenAI 还公布了其 Navier-Stokes
另有 1 家信源报道
2026年上半年,全球AI产业链上亿元融资事件共165起,总额约2.7万亿元。中国以77起融资事件数量居首,总额约1262亿元;美国以71起融资事件和约2.46万亿元金额领先,主要由OpenAI、Anthropic等头部企业拉动。国内融资集中于北京、上海、杭州、深圳,其中DeepSeek以500亿元单笔融资拉动杭州金额居首。融资向AI应用、视频生成、AI A
Strands Agents SDK 发布了 Python 版本 v1.55.0,包含多项新功能、修复和重构。新功能包括导出上下文管理器类型、为 Ollama、Writer 和 SageMaker 等模型提供缓存配置、MCP 服务器前缀和错误继续选项、以及新的本地代理和任务引擎。修复了文件编辑器、会话管理和 MCP 兼容性问题。文档更新包括模型路由指南和 A
AWS 博客介绍了如何使用 Amazon Bedrock AgentCore 和 GitHub Actions 构建自动化 agent 评估的 CI/CD 质量门禁。该方案通过 CDK 部署 agent 和 MCP 服务器,利用 AgentCore Evaluate API 对 agent 响应进行评分,并在评分下降时阻止 PR 合并。文章详细说明了 OAu
Agno 发布了 v3.0.7 版本,新增了页面存储、公共表面(PublicSurface)和页面文件系统等特性,并改进了工作流错误报告。修复了 Meta Llama 和 AIMLAPI 提供商的崩溃问题、Anthropic 空工具参数丢失问题以及缓存工具包装器导致的内存泄漏。同时引入了破坏性变更,如 Knowledge 构造函数参数改为仅限关键字,并调整了