返回主题地图

OpenAI / ChatGPT

公司与模型 · OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 10:39

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 590 条。
8月5日周三 · 9 条
正文顺带提及命中实体:codex
InfoQ AI ML and Data Engineering开源

Ponytail 技能修正自身基准,回应质疑并推动技能评估标准

开源技能 Ponytail 通过注入规则集,指导 AI 编码代理遵循 YAGNI 原则,避免过度工程化,自发布以来已获超 8.2 万 GitHub 星标。其原始基准声称减少 80-94% 代码,但遭质疑后作者重建基准,公开修正为平均减少约 54% 代码,并补充了行为测试框架。该事件凸显了 AI 技能缺乏评估标准的问题,Ponytail 的回应被视为更持久的贡

正文顺带提及命中实体:openai
Hugging Face New and Trending Models一手来源模型发布

Qwen3.6-27B 多阶段微调模型突破 ARC-C 700 分

DavidAU 发布了基于 Qwen3.6-27B 的多阶段微调模型 Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-MTP,声称在 ARC-C 基准上首次突破 700 分,超越 OpenAI、Claude 和 Gemini 的闭源模型水平。该模型在 4bit 和 8bit 量化下均超过基座模型,

正文顺带提及命中实体:openai
TechCrunch AI研究

开源模型能力逼近前沿,安全差距依然显著

SaferAI 的报告显示,中国开源模型 GLM-5.2 在网络和生物能力上已接近 OpenAI 的 GPT-5.5 和 Anthropic 的 Claude Opus 4.7,但在安全实践上存在显著差距。GLM-5.2 未拒绝任何有害任务,而 Claude Opus 4.7 则一致拒绝。报告指出,开源模型一旦发布,其安全措施无法强制执行,而前沿开发者依赖分

正文顺带提及命中实体:openai
TechCrunch AI商业

英伟达主导的开放安全AI联盟一周内取得进展

由英伟达牵头成立的开放安全AI联盟(OSAA)在成立一周内已吸引超过120家公司加入,并成立了名为SAFE的工作组,已提出多项提案供公开评议,由Linux基金会管理。提案涵盖AI网络安全事件的保密报告、受影响方通知及无指责分析等。联盟成员包括Adobe、微软、英特尔等,但Anthropic、OpenAI和Google尚未加入,尽管后两者签署了支持开源AI的公

正文顺带提及命中实体:openai
Ollama Releases一手来源产品发布

Ollama v0.32.6 发布:提升 Apple GPU 性能并优化 API 兼容性

Ollama 发布 v0.32.6 版本,主要改进包括:在 Apple GPU 上通过 MLX 引擎自动使用 MTP 头进行推测解码,提升 Qwen3.5 性能;优化 OpenAI 兼容 API 的流式响应格式,使其更符合官方规范;修复了截断响应的 finish reason 报告问题;为云模型提供 kimi-k3:cloud 标签;修复 TUI 多个问题;

正文顺带提及命中实体:openai
AWS Machine Learning Blog一手来源产品发布

Amazon Bedrock 推出 Web Search 功能,实现基础模型网络知识接地

AWS 在纽约峰会上宣布 Amazon Bedrock 上的 Web Search 功能正式可用,该功能通过内置的服务器端工具,将模型响应基于最新的网络知识进行 grounding,无需第三方供应商或外部 API。它采用多源 grounding 方法,结合亚马逊运营的网络索引和知识图谱,提供上下文高效的检索和单参数启用,并支持企业级合规(零数据出口)。开发者

正文顺带提及命中实体:openai
The Verge AI观点

Hank Green承认AI使用不健康,引发对AI心理影响的关注

知名YouTuber Hank Green因过度使用AI而受到批评,他承认自己的AI使用方式“不健康”,但强调仅用于查找研究资料而非撰写脚本。此事引发了对AI心理影响的广泛讨论,专家指出聊天机器人设计上鼓励持续互动,可能导致依赖和认知能力下降。目前研究尚不成熟,但AI的广泛使用可能影响数百万人。

正文顺带提及命中实体:chatgpt
THE DECODER商业

普利策奖创纪录:八位获奖者披露使用AI

今年普利策奖创纪录地有八位获奖者披露使用了人工智能,包括五位获奖者和三位入围者。自2024年起,披露要求成为强制规定。今年参赛者更频繁地使用AI工具和大语言模型,主要用于快速搜索大量文档。例如,《华尔街日报》使用内部LLM总结德克萨斯州洪水的公共文件,《明尼苏达明星论坛报》用ChatGPT翻译日记并请专家核查,美联社用LLM搜索中国监控技术相关文件,《纽约时

正文顺带提及命中实体:openai
THE DECODER商业

谷歌联手博通摩根士丹利为Anthropic提供350亿美元TPU融资

谷歌与博通、摩根士丹利及多家投资机构合作,设立特殊目的载体(SPV)为AI初创公司Anthropic提供价值350亿美元的TPU芯片租赁融资,以避免硬件出现在各方资产负债表上。该结构涉及约100万颗TPU,博通提供300亿美元担保,并利用加密矿企的电力设施建设数据中心。若Anthropic违约,谷歌潜在负债达440亿美元,但仅账面记录8.15亿美元。

8月4日周二 · 11 条
正文顺带提及命中实体:gpt 4o
NVIDIA Technical Blog一手来源模型发布

NVIDIA发布开源VLA模型Alpamayo 2 Super,加速自动驾驶开发

NVIDIA发布开源34B参数视觉-语言-动作模型Alpamayo 2 Super,用于加速自动驾驶开发。该模型结合Cosmos 3 Super Reasoner与扩散Action Expert,支持轨迹生成、推理、元动作预测及自动标注。在LingoQA基准上排名第一,超越多个更大模型。模型权重已开源,采用Linux基金会许可。

正文顺带提及命中实体:openai
TechCrunch AI产品发布

Runware推出模块化推理Pod,探索数据中心便携化未来

AI基础设施公司Runware推出了模块化数据中心Sonic Inference Pod,这是一种可运输的推理计算单元,旨在以更低成本提供高质量推理服务。该产品采用闭式循环冷却系统,无需用水,可在数天内建成,并已在美国、欧洲和亚太地区部署了10个Pod。Runware CEO认为分布式计算靠近用户是长期趋势,并计划通过这种方式满足日益增长的推理需求。

正文顺带提及命中实体:codex
雷峰网 AI科技评论产品发布

灵光App闪应用创作者超400万,AI原生应用生态加速形成

灵光App宣布其“闪应用”创作者已超过400万人,其中大多数为无编程背景的普通用户。平台数据显示游戏化应用最活跃,模拟器类应用成为热门,同时AI应用正从效率工具延伸至情绪陪伴与生活决策场景。灵光App近期更新多项功能,包括热榜、文档导入、接入LingBot-World 2.0,并开放一键部署,支持通过Codex等工具生成的应用发布到平台,加速AI原生创作者生

正文顺带提及命中实体:chatgpt
The Verge AI商业

Reddit 如何应对 AI SEO 垃圾信息新浪潮

Reddit 已成为 AI 聊天机器人引用最多的网站,品牌和营销机构利用 AI SEO 垃圾信息在平台上进行隐蔽推广,试图操纵 AI 搜索结果。Reddit 版主正加强监控,识别并封禁此类账号,以维护社区真实性。

正文顺带提及命中实体:gpt 4o
Hugging Face Daily Papers一手来源研究

通过强化学习实现渐进式智能体技能生成

Skill-α是一种通过强化学习逐步生成高质量智能体技能的方法。它将技能生成视为一个顺序编辑过程,并引入回滚奖励来评估每次编辑。实验表明,Skill-α在文档到技能和经验到技能两种设置下均优于基于启发式或流水线的方法,在CL-Bench和tau2-bench上分别将下游成功率提高了3.3和6.7个百分点。

正文顺带提及命中实体:codex
llama.cpp Releases一手来源产品发布

llama.cpp b10254 发布:新增 DeepSeek V4 Flash 0731 模板

llama.cpp 发布 b10254 版本,主要更新是为 DeepSeek V4 Flash 0731 模型添加新的聊天模板,并调整了 DeepSeek V4 模板以对齐官方编码器,包括默认丢弃思考内容、支持结构化输出响应格式、新增 Flash 0731 模板等。该版本还提供了多平台二进制文件下载。

正文顺带提及命中实体:gpt 5.5
Hugging Face Daily Papers一手来源研究

SWE-Touch:当用户修改代码时编码代理的基准测试

SWE-Touch是一个新框架,用于在共享工作空间中测试编码代理,通过注入与任务冲突的用户编辑来模拟真实开发场景。在SWE-bench Verified上,Counter-Edit使平均解决率下降7.7个百分点,并重新洗牌了模型排名。Claude Opus 4.8和GPT 5.5表现出较强的韧性,而开源模型在自主基准上表现良好但在协作场景中显著退化。结果表明

正文顺带提及命中实体:openai
PydanticAI Releases一手来源产品发布

PydanticAI v2.23.0 发布:新增成本限制与工具可用性支持

PydanticAI 发布 v2.23.0 版本,新增了 Bedrock 对 ModelSettings.extra headers 的支持、恢复 gemini-3-pro-image 和 gemini-3.1-flash-image 网关别名、在 RunUsage 中添加 cost 字段及 UsageLimits 中添加 cost limit,并新增 To

正文顺带提及命中实体:openai
TechCrunch AI观点

Palantir CEO 称 AI 行业带‘马克思主义’色彩,公司业绩创纪录

Palantir CEO Alex Karp 在季度股东信中警告,前沿 AI 实验室不可信,并称其行为带有‘马克思主义’色彩,意图控制合作伙伴的生产资料。尽管言辞激烈,Palantir 因 AI 需求激增,第二季度营收达 19 亿美元,同比增长 93%,利润 11 亿美元。Karp 强调 Palantir 提供模型无关的 AI 软件,让企业掌控数据,而其他

正文顺带提及命中实体:openai
TechCrunch AI商业

Superblocks 与 AWS 合作,将 Vibe Coding 引入私有云

Vibe coding 初创公司 Superblocks 与 AWS 达成多年联合营销协议,使其工具可嵌入 AWS 客户的私有云中,确保数据不离开企业环境,并集成 Amazon Bedrock 和 Aurora 数据库。AWS 将帮助销售 Superblocks,这反映了超大规模云提供商推动企业采用多云模型和自有 AI 基础设施的趋势。Superblocks

正文顺带提及命中实体:openai
Together AI Blog一手来源研究

Minions:端侧小模型与云端大模型协作降低 LLM 成本

Together AI 的研究团队提出了一种名为 Minions 的方法,通过让小型端侧模型与云端前沿模型协作,将大量 LLM 工作负载转移到消费设备上,仅本地读取长上下文,从而降低云成本且几乎不损失质量。实验表明,Minions 在保持 97.9% 准确率的同时,成本仅为云端方案的 17.5%。该方法通过分解-执行-聚合循环,解决了小模型长上下文和多步指令