返回主题地图

Kimi / 月之暗面

公司与模型 · 月之暗面 Kimi 系列模型与产品动态:K 系列开源模型、长上下文技术与产品演进

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 81 条。
8月27日周四 · 1 条
正文顺带提及命中实体:kimi k3
Latent Space商业

NVIDIA 130 亿美元收购 HuggingFace,GLM-5.3-Flash 发布

NVIDIA 以 130 亿美元收购 HuggingFace,约为其 1.5 亿美元 ARR 的 80 倍,较 2026 年 1 月 70 亿美元的报价近乎翻倍。同时,Z.ai 正式发布 GLM-5.3-Flash(即 Ox Alpha),这是一个 320B 总参数、18B 激活参数的 MIT 许可多模态模型,支持 1M 上下文,完全运行在中国 AI 芯片上

8月26日周三 · 1 条
正文顺带提及命中实体:kimi
智东西产品发布

苹果发布M6/M5 Pro Mac mini及Mac Studio,AI性能大幅提升

苹果发布新款Mac mini和Mac Studio,Mac mini首发2nm M6芯片,AI性能大幅提升,Mac Studio搭载M5 Max/Ultra芯片,支持本地运行大模型。同时,苹果与阿里巴巴联合训练面向中国市场的AI大模型,推进Apple智能落地。此外,苹果计划在9月发布折叠屏iPhone等新品。

8月25日周二 · 2 条
正文顺带提及命中实体:kimi k3
雷峰网 AI科技评论研究

李飞飞押注的空间智能:生成的世界如何经得起折腾?

李飞飞押注的空间智能被视为世界模型的主流路线之一,其核心是让AI从识别二维画面走向理解、推理和生成可进入、操作的三维世界。文章指出,真正的考验在于构建一个“站得住”的世界,需要解决速度瓶颈和状态瓶颈,并提出了Renderer、Simulator与Planner的架构,以及递归自我改进(RSI)的闭环。国内创业公司生境科技展示了类似的技术思路,通过状态层驱动实

正文顺带提及命中实体:kimi k3
量子位研究

VC用AI预测未来:DigClaw框架在FutureX获三个前十

DigClaw公司的预测框架Rhizome v1在FutureX评测平台上获得三个前十席位,验证了预测能力可独立于基座模型。该框架通过搜索与推理解耦、轨迹记录与概率校准、因果链感知更新三大设计,降低了过度自信率。DigClaw及其关联的Newborn Ventures将这一能力应用于投资决策,并计划向产业方、金融机构和政府引导基金开放服务。

8月24日周一 · 1 条
正文顺带提及命中实体:kimi k3
Hugging Face New and Trending Models一手来源模型发布

Ornith AI 发布 397B 自改进模型 Ornith-1.5,性能对标 Claude Opus 4.8

Ornith AI 发布了 Ornith-1.5-397B,这是一个 397B 参数的混合专家模型,通过端到端自我改进训练,在 Terminal-Bench 2.1 上得分 86.1,在 DeepSWE 上得分 56.0,性能与 Claude Opus 4.8 相当,并优于 GLM-5.2 和 DeepSeek-V4-Flash-0731 等开源模型。该模型

8月21日周五 · 3 条
正文顺带提及命中实体:kimi k3
量子位产品发布

雷鸟iO发布:轻至34g,全天候主动式AI眼镜

雷鸟创新发布全新雷鸟iO系列AI眼镜,主打轻至34g的日常佩戴设计、两天续航及全天候主动式AI功能,支持DeepSeek V4 Pro等大模型,并强调隐私保护。该产品定价1996元起,旨在推动AI眼镜从尝鲜品走向大众日常使用。

正文顺带提及命中实体:kimi k3
TechCrunch AI商业

AI 数据初创 Micro1 年营收达 5 亿美元,受益于训练数据需求激增

AI 数据初创公司 Micro1 在八个月内将年度总营收从 1 亿美元提升至 5 亿美元,净营收约 1.5 亿至 2 亿美元。该公司为顶级实验室和企业提供 AI 训练数据,并越来越多地生成合成数据,毛利率可达 80%-90%。其创始人表示不向中国模型制造商出售数据,以维护美国 AI 优势。

正文顺带提及命中实体:moonshot
TechCrunch AI产品发布

Ramp 推出 AI 模型路由服务 Router

企业支出管理平台 Ramp 推出了自己的 AI 模型路由服务 Router,允许用户和公司通过 API 使用和切换多种大语言模型。该服务目前仅在美国可用,2026 年剩余时间内免费,并提供 26 美元信用额度。Router 提供来自 OpenAI、Anthropic、DeepSeek 等多家公司的模型,并支持多种路由策略和仪表盘监控。此举旨在进入 AI 推理

8月19日周三 · 2 条
正文顺带提及命中实体:moonshot
THE DECODER商业

中国允许英伟达H200芯片小批量进入以助AI企业追赶美国

中国允许英伟达H200芯片小批量进入大陆,字节跳动和腾讯各获得约1万颗,以帮助国内AI企业追赶美国。H200比英伟达最先进芯片落后至少两代,因美国出口管制无法购买更先进的。中国还支持华为等本土制造商,但国内AI公司在推理能力上仍落后于美国,且需求激增导致部分公司如Moonshot不得不拒绝客户。

正文顺带提及命中实体:kimi k3
Latent Space观点

Glean CEO:模型路由因成本与开源模型流行而需求激增

Glean CEO Arvind Jain 在接受 Latent Space 采访时表示,模型路由正成为企业控制 AI 成本的关键,因为前沿模型价格高昂且开源权重模型(如 Kimi K3、Qwen3.8-Max)日益流行。Glean 通过三级模型选择(用户手动、管理员限制、自动路由)和人类反馈循环优化路由,其 Waldo 模型负责在调用前沿模型前组装原始材料

8月17日周一 · 1 条
正文顺带提及命中实体:kimi k3
Import AI研究

Import AI 469:科学AI、RSI模拟器与扎克伯格的技术悲观主义

Import AI 第469期介绍了三个AI研究进展:DiG-bench基准测试通过70个游戏评估AI在未知环境中的发现能力,结果显示Opus 5和Fable 5表现最佳但远未达到人类水平;Paradigm Research发布了一个模拟递归自我改进的浏览器游戏;AI初创公司Inherent发布了论文,介绍其构建的AI科学家模型Faraday,用于监督前沿模

8月14日周五 · 3 条
正文顺带提及命中实体:kimi k3
雷峰网 AI科技评论模型发布

GLM-5.3发布:编程能力暴涨50%,安全性能对标顶尖模型

智谱发布GLM-5.3模型,在基座不变的情况下,通过后训练技术使编程能力提升50%,并宣称在安全领域发现2436个漏洞,包括潜伏40年的DNS协议漏洞。该模型在多个评测中逼近或超越Claude Fable 5,并开源,同时推出编程工具ZCode和AutoClaw。

正文顺带提及命中实体:kimi
THE DECODER模型发布

智谱AI发布GLM-5.3,称最强开源编码模型

中国AI初创公司智谱AI发布了GLM-5.3模型,声称其是最强大的开源权重编码模型,所有改进均来自扩展的后训练。该模型在基于代理的任务上表现突出,并在网络安全方面通过训练发现软件漏洞,共发现2436个漏洞。GLM-5.3现已通过GLM编码计划提供,权重将在两周后开源。

正文顺带提及命中实体:kimi k3
THE DECODER产品发布

Deepseek 发布 V4-Pro 更新,开源代理软件并上调 API 价格

Deepseek 发布了 V4-Pro 模型的更新版本(V4-Pro-0813),在代理基准测试中得分显著提升,但仍落后于 Claude Opus 5 等顶级模型。同时,公司开源了其代理软件 Deepseek Harness(MIT 许可),并提高了 API 价格,尤其是缓存命中的费用。这些举措发生在公司融资和准备 IPO 的背景下。

8月13日周四 · 1 条
正文顺带提及命中实体:kimi k3
量子位模型发布

DeepSeek V4 Pro正式版发布,Agent能力对标Fable 5

DeepSeek发布了V4 Pro正式版,API平台已更新至DeepSeek-V4-Pro-0813,多项基准测试显示其Agent能力接近或超越Fable 5和Opus 4.8。价格与预览版持平,但网友发现其思维链输出变得简略,可能影响写作能力。该发布被视为国产开源模型在性价比之外向SOTA发起冲击的标志。

8月12日周三 · 4 条
正文顺带提及命中实体:kimi k2
Interconnects AI观点

AI写作能力停滞:长篇非虚构写作的挑战与反思

作者撰写了一本关于强化学习人类反馈(RLHF)的教科书,并反思了AI在长篇非虚构写作上的停滞。他认为,尽管模型在编码和数学上进步显著,但在组织知识、保持连贯性方面仍显不足,这限制了AI在科学发现中的自主性。作者对AI作为辅助工具持乐观态度,但认为其尚需人类引导。

正文顺带提及命中实体:kimi k3
THE DECODER模型发布

英伟达 Nemotron 4 目标万亿参数,规模仍不及中国模型

英伟达正在开发新一代开源权重模型 Nemotron 4,其最大版本参数规模至少达一万亿,是 Nemotron 3 Ultra 的两倍,最早可能于今年秋季发布。为此,英伟达已将其用于内部模型训练的云支出增加至 2031 年的 280 亿美元。尽管规模庞大,但中国实验室已超越这一水平,如 Moonshot AI 的 Kimi K3 有 2.8 万亿参数,Deep

正文顺带提及命中实体:kimi k2
Hugging Face Blog一手来源研究

2026年前沿模型如何基于结果进行训练

本文是Hugging Face博客关于2026年前沿模型训练方式的补充材料,梳理了OpenAI、DeepSeek、Meta等实验室在强化学习(RL)后训练中的公开做法。文章指出,可验证奖励(RLVR)已成为主流,GRPO算法被广泛采用但多有修改,且RL正从单答案转向环境交互。作者通过引用各实验室报告,展示了这些模式如何贯穿从7B模型到前沿系统的训练流程。

正文顺带提及命中实体:moonshot
arXiv cs.MA一手来源研究

中国前沿大模型合作行为并非铁板一块:实验室间差异显著

本研究通过进化迭代囚徒困境实验,比较了四款中国前沿大模型(DeepSeek V4 Pro、Qwen3-Max、Kimi K2.5、GLM-5.1)的合作倾向。研究发现,这些模型并非铁板一块,实验室间差异显著,且中国模型内部的差异大于中国与西方生态系统之间的平均差异。研究还发现,中国模型的合作倾向普遍性较弱,但这一结论受转换器选择影响。

8月11日周二 · 1 条
正文顺带提及命中实体:kimi k3
THE DECODER商业

Anthropic巨型IPO面临投资者质疑:中国竞争与政治阻力

Anthropic计划于9月或10月进行IPO,估值达9650亿美元,这将成为AI行业估值的基准。在初步投资者会议中,投资者对中国廉价AI模型的竞争、与特朗普政府的政治紧张关系以及数据中心建设的阻力表示担忧。Anthropic淡化中国竞争,强调其专注于顶级模型,并计划通过健康与生物学应用来应对负面情绪。此次IPO的定价和上市后表现将影响整个AI行业的估值。