返回主题地图

NVIDIA 英伟达

公司与模型 · 英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力供给

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 05:49

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 229 条。
9月9日周三 · 2 条
正文顺带提及命中实体:nvidia
TechCrunch AI商业

Cognition 估值达 480 亿美元,AI 编程市场仍有多强竞争空间

AI 编程初创公司 Cognition 宣布完成 20 亿美元融资,估值达 480 亿美元,较四个月前翻倍。其年化收入从 4.92 亿美元增至 9 亿美元,但烧钱严重,预计今年达 8 亿美元。投资者认为 AI 编程市场仍有多个主要玩家的空间,Cognition 正自研模型以降低对第三方模型的依赖。

正文顺带提及命中实体:nvidia
智东西商业

联想高管谈AI PC下一站:ChatGPT时刻正在发生

联想在IFA 2026上发布多款AI终端,包括搭载NVIDIA RTX Spark的Yoga笔记本和概念机,并升级个人智能体Qira(国内名天禧),实现跨设备系统级AI体验。联想IDG总裁Luca Rossi表示,AI PC的'ChatGPT时刻'正在发生,高额云Token成本推动需求,未来12个月势能加速释放。联想AI PC市场份额达25.1%居全球第一,

9月8日周二 · 4 条
正文顺带提及命中实体:nvidia
TechCrunch AI商业

Mistral融资30亿欧元,主权AI成热门赛道

法国AI实验室Mistral AI宣布完成30亿欧元(约35.8亿美元)融资,估值超210亿欧元,由三星电子领投,EQT旗下基金和PSG Equity联合领投,创欧洲科技公司最大股权融资纪录。资金将用于扩大计算能力、建设基础设施、加速商业增长和国际扩张。Mistral强调其目标不是打造欧洲版ChatGPT,而是通过提供主权AI基础设施和第三方模型托管服务,帮

另有 1 家信源报道

正文顺带提及命中实体:nvidia
Interconnects AI研究

开源模型许可分化:智谱GLM-5.3定制许可引关注,多款新模型发布

2026年开源模型竞争加剧,西方厂商(谷歌、Meta)转向Apache 2.0许可,而中国前沿厂商(Kimi、MiniMax、智谱)采用更严格的定制许可。智谱GLM-5.3从MIT改为定制许可,要求收入超100亿美元的推理/微调服务商通过Z.AI安全审查,但“关联方”定义模糊引发采用障碍。本期还推荐了Motif-3、dots3-note-prev、Qwen3

正文顺带提及命中实体:nvidia
Mistral AI News一手来源商业

Mistral 完成 30 亿欧元融资,推动主权开放权重 AI

Mistral AI 宣布完成 30 亿欧元 D 轮融资,估值超 210 亿欧元,为欧洲科技公司最大股权融资。三星电子领投,资金将用于扩展前沿研究、计算能力和商业版图。Mistral 强调其开放权重全栈方案,旨在提供主权 AI,使企业保持数据、模型、计算和系统的控制权。

另有 1 家信源报道

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源产品发布

llama.cpp b10844 为 Vulkan 添加 DeepSeek-V4 融合算子

llama.cpp 发布 b10844 版本,为 Vulkan 后端添加了 DeepSeek-V4 超连接融合算子(DSV4 HC COMB/PRE/POST),将 Sinkhorn 迭代等操作融合到寄存器中,大幅减少调度次数,提升解码性能。该版本还包含多个平台的二进制构建。

9月7日周一 · 2 条
正文顺带提及命中实体:nvidia
量子位模型发布

GPT-6 Sol内测曝光:速度是Astra的6倍,OpenAI研究员人均带3个AI实习生

OpenAI正在内部测试GPT-6 Sol模型,其单次测试速度是刚发布的Astra的6倍,但输出能力较弱。同时,OpenAI披露内部数据显示,研究员人均使用3个AI Agent辅助工作,并宣布实现自动化AI研究实习生目标。首席科学家Jakub Pachocki发文呼吁行业减速,并警告AI监控难度加大。

正文顺带提及命中实体:nvidia
量子位商业

GOSIM Shenzhen 2026 全议程公布:DHH领衔,聚焦开源AI技术栈

GOSIM Shenzhen 2026 开源技术大会将于 10 月 16-17 日在深圳举办,由 DHH 领衔,汇聚英伟达、微软、HuggingFace 等 150+ 全球讲师。大会设置 6 大技术主题论坛、7 场 Workshop、4 场 Hackathon 及 Spotlight 项目路演,聚焦 Agent、开源模型、机器人、边缘智能等下一代开源 AI

9月5日周六 · 2 条
正文顺带提及命中实体:nvidia
InfoQ AI ML and Data Engineering观点

QConAI 2030 预测演讲:token 成本与 AI 未来趋势

Doubleword 联合创始人 Meryem Arik 在 QConAI 2030 上预测了 AI 行业未来趋势,涵盖 token 支出、基础设施、代理、监管和职业发展。她指出 token 成本已成为企业问题,并驳斥了 AI 实验室补贴 token 的说法,认为 token 价格将持续下降。她还预测了企业采用 AI 的速度和前沿模型改进的速度。

正文顺带提及命中实体:nvidia
智东西研究

d-Matrix详解3D-DRAM AI芯片:带宽超100TB/s,能效比HBM高10倍

在Hot Chips 2026大会上,AI推理芯片初创公司d-Matrix详细介绍了其Raptor 3D-DRAM加速器,该芯片采用台积电N4逻辑裸片与3D DRAM面对面堆叠,单卡带宽超100TB/s,能效比HBM高10倍。Raptor通过Stream Blocking、Stream Flipping和Bank Chaining等创新技术解决了带宽浪费、I

9月4日周五 · 4 条
正文顺带提及命中实体:nvidia
THE DECODER商业

Deepseek计划在内蒙古部署16万颗华为芯片,打造最大集群

Deepseek计划在内蒙古建设一个大型数据中心,部署至少16万颗华为下一代Ascend-950DT芯片,这将是已知最大的华为芯片集群,但仅用于推理,训练仍依赖英伟达硬件。由于生产限制和内存短缺,华为可能无法在一年内交付全部订单,而中国内存制造商CXMT首次小批量生产HBM3E,但技术仍落后三星等厂商三至五年。此举是中国政府推动芯片产业自主化的一部分。

正文顺带提及命中实体:nvidia
Hugging Face New and Trending Models一手来源模型发布

Primitive AI 发布 Qwen3.8-Flash-Next NVFP4 量化版,单 GPU 可运行

Primitive AI 发布了 Qwen3.8-Flash-Next 的 NVFP4 量化版本,使 180B 参数的模型能在单张 96GB Blackwell GPU 上运行。该量化模型在 9 项基准测试中平均得分 92.2,支持 MTP 投机解码,并提供了详细的部署方案,包括 CPU 卸载和 NVMe 映射选项。

正文顺带提及命中实体:nvidia
llama.cpp Releases一手来源产品发布

llama.cpp b10796 发布:新增 n expert used max 函数支持异构 MoE

llama.cpp 发布 b10796 版本,新增 n expert used max 函数以支持每层具有不同专家数量的 MoE 模型,修复了模型加载时的错误检查问题。该版本提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件。

正文顺带提及命中实体:nvidia
TechCrunch AI商业

Thinking Machines 洽谈 400 亿美元估值融资 10 亿美元

据 The Information 报道,由前 OpenAI CTO Mira Murati 创立的 AI 实验室 Thinking Machines 正在洽谈以至少 400 亿美元估值融资 10 亿美元,现有投资者 Accel 领投。该公司年化收入超过 1 亿美元,估值倍数极高。此前该公司曾寻求 500 亿美元估值,且其 20 亿美元种子轮融资曾创纪录。

9月3日周四 · 3 条
正文顺带提及命中实体:nvidia
TechCrunch AI模型发布

谷歌发布AI天气模型WeatherNext 3,提升预报精度与频率

谷歌DeepMind和谷歌研究院发布了新一代AI天气预报模型WeatherNext 3,该模型在分辨率、降雨预测和更新频率上均有显著提升,并已集成到谷歌搜索、地图和Gemini等产品中。在基准测试中,它超越了其他AI模型和传统预报系统。该模型能直接吸收实时卫星数据,实现每小时更新,并针对特定气象站进行预测,有望提升全球天气预报的准确性和实用性。

另有 2 家信源报道

正文顺带提及命中实体:nvidia
量子位模型发布

影眸发布世界生成模型WorldGen,单图直出可交互3D场景

影眸Hyper3D发布世界生成模型WorldGen,可将单张图片在2-3分钟内生成可交互、可编辑的3D场景,每个资产独立且具备物理属性。该技术基于其获SIGGRAPH 2025最佳论文的CAST技术,已应用于具身智能、游戏、影视和XR领域,并与Unity中国、地瓜机器人等合作。WorldGen旨在将3D生成从单资产推向完整场景,解决产业中场景搭建的前置难题。

正文顺带提及命中实体:nvidia
THE DECODER商业

Anthropic与Lambda签署350亿美元数据中心协议,扩展Claude基础设施

Anthropic与英伟达支持的云服务商Lambda签署了一项价值350亿美元的数据中心协议,该设施位于得克萨斯州,由Hut 8开发,英伟达持有租约。这是Anthropic在IPO前大规模基础设施投资的一部分,此前其已与Nscale达成450亿美元合同。此举旨在满足其AI模型Claude及编码工具Claude Code日益增长的需求。

另有 1 家信源报道

9月2日周三 · 1 条
正文顺带提及命中实体:nvidia
TechCrunch AI商业

AfterQuery估值32亿美元,成Y Combinator最快独角兽

AI训练数据初创公司AfterQuery据报道完成一轮融资,估值达32亿美元,距其4月宣布的3亿美元估值仅五个月,增长超10倍。Y Combinator合伙人称这是该加速器历史上从创立到独角兽最快的一次。该公司为AI模型和智能体提供专业工作模式训练,客户包括Nvidia等。

9月1日周二 · 2 条
正文顺带提及命中实体:nvidia
TechCrunch AI产品发布

五角大楼推出定制版ChatGPT和Grok供军事人员使用

美国国防部在GenAI.mil门户中推出了定制版ChatGPT(ChatGPT Mil)和Grok(Grok for Government),供300万军事和文职人员使用,以加速工作并增强作战能力。该门户已吸引超过170万用户,但未包含Anthropic的Claude模型,因其被特朗普政府标记为供应链风险。此举是五角大楼更广泛AI战略的一部分,旨在平衡安全与

正文顺带提及命中实体:nvidia
AWS Machine Learning Blog一手来源商业

AWS获评Forrester Wave AI基础设施解决方案领导者

AWS在Forrester Wave 2025年第四季度AI基础设施解决方案评估中被认定为领导者,在13家供应商中战略类别得分最高。该评估认可了AWS提供灵活、成本高效的AI基础设施,支持从训练到推理的完整工作负载生命周期。AWS提供专有AI芯片(如Inferentia和Trainium)以及NVIDIA GPU实例,强调客户选择和成本效率,避免供应商锁定。