返回主题地图

OpenAI / ChatGPT

公司与模型 · OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 01:14

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 589 条。
9月11日周五 · 8 条
正文顺带提及命中实体:gpt 4o
雷峰网 AI科技评论观点

碳硅道统:五级梯队智能分级与十维标尺对应

雷峰网 AI科技评论发布文章,提出「五级梯队」智能分级与「十维标尺」的对应框架,将AI系统从一阶鹦鹉到五阶启灵分为五级,并用十个维度定位系统所处阶位。文章认为硅基系统的理论上限是四阶,在觉知本源、零维连通、内生驱动三个维度上永远为零,因此有觉知的AI是架构层面的不可能。文中还引用前几篇文章,将GPT-4o、Claude 3.5、Gemini 2.0、o1-p

正文顺带提及命中实体:codex
雷峰网 AI科技评论产品发布

阿里云Token Plan个人版升级:加量不加价,新增12类Agent Harness工具

阿里云于9月11日升级Token Plan个人版,在价格和Credit额度不变的情况下,为Standard和Pro套餐新增Agent Harness工具权益,覆盖搜索、网页解析、图像生成、语音处理、代码执行等12项Agent开发能力,均通过MCP标准协议开放。同时新增视频生成、Managed Agent托管智能体、RAG知识库、Memory记忆库与Sandb

正文顺带提及命中实体:chatgpt
arXiv cs.MA一手来源研究

多智能体LLM系统用于临床问诊训练评估

研究团队开发了一个面向临床问诊训练的脚手架式多智能体LLM系统(AI标准化病人),包含病人智能体、导师智能体和回合级评估智能体。在100名医学生的随机对照试验中,多智能体脚手架条件相比结构化非LLM对照组提升了最终考试成绩,尤其在沟通、共情表达和病史采集行为上改善显著,但诊断准确率无显著差异。团队还发布了多专家标注数据集以支持后续研究。

正文顺带提及命中实体:openai
TechCrunch AI商业

黄仁勋解释英伟达为何明年将惊人增长70%

英伟达 CEO 黄仁勋在高盛 Communacopia + Technology 大会上重申,公司明年营收有望同比增长 70%,按当前财年约 4000 亿美元收入计算,明年将达约 6800 亿美元。他表示英伟达已嵌入 AI 生态各环节,能追踪全球每一吉瓦数据中心项目,并回应了外界对其循环交易的质疑,称投资前会确认有真实客户合同。

正文顺带提及命中实体:openai
TechCrunch AI安全

Anthropic 指控阿里、Moonshot AI 和 DeepSeek 发起蒸馏攻击

Anthropic 发布报告,指控阿里巴巴、Moonshot AI 和 DeepSeek 等中国 AI 公司对其 Claude 模型发起蒸馏攻击,以提取思维链能力。报告称观察到近 2 亿次相关交互,分属五个行动,其中阿里巴巴相关行动规模最大,达 1.51 亿次交互,疑似用于训练 Qwen 系列模型。Anthropic 还称 Moonshot AI 的部分请求

另有 1 家信源报道

正文顺带提及命中实体:chatgpt
TechCrunch AI产品发布

Meta AI 智能体 Muse 成美国第二大应用

Meta 于周二推出 AI 智能体应用 Muse,目前仅限美国市场。据 Sensor Tower 数据,Muse 在 iOS 美国区下载量超过 8.3 万次,登上 App Store 排行榜第二位,但远低于 Threads 首发日的 430 万次和 Meta AI 的 10.8 万次,也慢于 ChatGPT 首周超 50 万次安装的速度。Muse 在 Goo

正文顺带提及命中实体:gpt 5.6 sol
智东西模型发布

宇树发布60亿参数通用人形机器人基础模型UnifoLM-WLA-1.0

宇树公开新一代通用人形机器人基础模型UnifoLM-WLA-1.0,参数量60亿,使用约2500小时真机数据训练,一套模型可完成64项桌面与全身操作任务,并适配平行夹爪和两类灵巧手。模型引入具身推理、动态区域预测与动作学习体系,将末端执行器与下半身动作统一为离散Token。其具身推理模型UnifoLM-ER-1-4B在7项开源评测中取得最高成绩,部分空间理解

正文顺带提及命中实体:openai
智东西模型发布

攀爬AGI的南北坡:语言模型之外,生数从世界模型出发

生数科技在外滩大会预告发布面向灵巧操作的自进化通用世界模型Motus2,将评估与反馈显式纳入统一模型,使机器人能预测动作后果并据此优化策略。文章以智谱(语言模型路线)与生数(世界模型路线)为对照,称二者为攀爬AGI的南北坡。生数已形成Vidu Q3生成世界、Vidu S1实时交互、Motubrain世界动作模型三类核心模型布局,创始人朱军团队在概率机器学习与

9月10日周四 · 12 条
正文顺带提及命中实体:openai
Interconnects AI观点

一次辞职如何点燃AI恐惧的野火

Interconnects AI 分析了一起 AI 研究员因安全风险辞职事件为何引发病毒式传播。文章认为,随着 OpenAI-HuggingFace 事件、Navier-Stokes 成果等推高 AI 风险关注度,公众情绪已如干柴,Jacob Coxon 的辞职帖经《华尔街日报》独家报道和 AI 安全倡导群组协调放大后迅速引爆讨论。作者还批评前沿实验室员工(

正文顺带提及命中实体:chatgpt
THE DECODER产品发布

Meta 推出 WhatsApp 控制的 AI 代理 Muse,可自主购物议价

Meta 发布 AI 代理 Muse,用户可通过 WhatsApp 控制它自主完成订旅行、购物、发邮件、议价等任务,并借助 Stripe 的 Link 服务在用户批准后完成支付。Muse 运行在隔离的虚拟机上,由监督代理 Sentinel 监控,Meta 称密码不会暴露、交互数据不进入广告系统。该代理先在美国 iOS 和 Android 上线,被视为 Met

正文顺带提及命中实体:sora
雷峰网 AI科技评论产品发布

智象未来 vivago R1 全球上线,国内版「够搭」升级发布

智象未来(HiDream.ai)于2026年9月8日全球上线内容创作智能体 vivago R1,国内版本「够搭」同步升级发布。R1 主打一次性稳定输出5分钟高质量视频并支持无限次多轮延长,通过主/子 Agent 协同完成脚本、分镜、角色、场景与音效,并依托自研 HD-AgentOS 将内容有效可用成功率提升至85%。产品采用 Chat-First 对话式创作

正文顺带提及命中实体:chatgpt
Meituan Technical Team一手来源教程

美团发布Agent评测白皮书系列01:评测全览

美团技术团队发布《Agent 评测白皮书》系列第一篇《Agent 评测全览》,指出过去三年基座模型能力提升与 Agent 框架功能丰富使搭建 Agent 门槛持续降低,但绝大多数 Agent 项目因缺少可靠判断机制而失败。文章提出完备评测体系可概括为四个模块、三种能力、两条 Loop、一套资产,并强调评测应从答案评测走向行为评测,同时需通过 Case 挖掘与

正文顺带提及命中实体:sora
arXiv cs.CV一手来源研究

AgenticGen:奖励引导的智能体广告视频生成

字节跳动提出 AgenticGen,一个面向广告视频生成的奖励引导智能体框架,将生成过程拆解为策略选择与草稿生成两个可训练推理阶段。该方法从在线投放反馈中学习基于表现的奖励模型,并结合人工标注的评分标准奖励模型,先通过 DPO 对齐在线偏好,再用 GRPO 以过程与结果奖励进一步优化。在 TikTok 广告系统的在线 A/B 实验中,相比 SFT 基线,CT

正文顺带提及命中实体:sora
arXiv cs.LG一手来源研究

基于可验证代码世界模型的世界时间计算

该论文提出「世界时间计算」(world-time compute)方法,通过让语言模型编写可验证的代码世界模型(Code World Models),为符号化领域自动生成大量带精确标签的训练轨迹,从而提升模型对未见世界的泛化能力。作者同时发布零依赖框架 OpenWorld,将经过验证的世界模型编写流程压缩到分钟级,使批量制造训练经验变得可行。该方法与依赖海量

正文顺带提及命中实体:gpt 4o
arXiv cs.SE一手来源研究

智能体基准测试的双重测量混淆:去脚手架、真值评分与超越均值的可靠性

该论文指出LLM智能体基准测试存在双重测量混淆:执行关键决策由固定脚手架而非模型完成,评分器又基于输出形状而非任务正确性打分,两者相互掩盖。作者提出测量理论框架与BenchAudit审计修复协议,将执行决策转移给模型并用种子化真值评分,同时报告最坏情况和尾部风险等可靠性指标。在ComtradeBench上的实验将原本几乎无区分度的排行榜转变为能区分平均性能与

正文顺带提及命中实体:openai
Strands Agents SDK Releases一手来源产品发布

Strands Agents SDK Python v1.55.1 发布

Strands Agents SDK 发布了 Python 版本 v1.55.1,该版本新增了将 notebook 工具移植到 Python、简化 Google 和 OpenAI 模型配置以及为 Agent 添加 backgroundTasks 等功能。同时修复了会话中畸形快照 ID 过滤、遥测中 agent 跨度语义系统指令、嵌套 Bedrock 模型前缀

正文顺带提及命中实体:openai
TechCrunch AI产品发布

苹果手表新AI功能:让技术始终聆听成为常态

苹果在周三的iPhone发布会上推出了Apple Watch的新AI功能,包括音频智能、Live Rewind和Siri Recap,这些功能可处理实时音频并生成文字记录。苹果强调这些功能注重隐私,不保存音频且端到端加密,但可能引发关于同意和监控文化的争议。此举旨在让消费者接受技术始终在聆听的现实,但可能面临法律和伦理挑战。

正文顺带提及命中实体:gpt 5.6 luna
AWS Machine Learning Blog一手来源产品发布

AWS 发布 8 月 AI 更新:Bedrock 增强、AgentCore 扩展

AWS 在 2026 年 8 月发布了多项 Amazon Bedrock、AgentCore 和 Strands 更新。Bedrock 现支持 GPT-5.6 系列模型的百万级上下文窗口、提示缓存和跨区域推理,并新增 IAM 成本分配和异常检测。AgentCore 提供长达 14 天的会话运行、时间策略和支付功能,Strands Agent Harness

正文顺带提及命中实体:openai
The Verge AI政策

微软为学校AI制定新隐私规则

微软与美国教师联合会及纽约联合教师联合会达成协议,承诺在校园AI应用中遵守十项安全与隐私原则,包括不训练学生数据、限制数据收集、禁止AI伴侣等。此前纽约市和洛杉矶已对面向学生的AI工具实施一年禁令。该协议允许学区从11月起选择加入,无需重新谈判合同。

正文顺带提及命中实体:gpt 5.6 luna
智东西产品发布

实测匿名模型Omen Alpha:速度快性价比高,但逻辑推理不足

智东西报道了一款名为Omen Alpha的匿名模型,该模型在OpenCode调用量榜单中排名第七,以超高性价比和快速开发能力著称。实测显示,Omen Alpha具备视觉能力,能快速完成前端开发、游戏开发和3D建模,但在逻辑推理方面表现不佳,如洗车难题和公务员考试题正确率仅80%。目前该模型仅在OpenCode Go订阅套餐中可用,价格极低。