返回主题地图

芯片与算力

产业与政策 · 加速卡、算力供给与硬件供应链 · 共 243 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

9月23日周三 · 6 条
正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp b11111:新增 Intel Xe Vulkan 闪存注意力优化内核

llama.cpp 发布 b11111 版本,主要更新为在 Vulkan 后端新增 Intel Xe 闪存注意力(flash attention)优化内核,覆盖 Xe-LPG Plus、Xe2、Xe3 架构,并针对 split k 路径做优化。同时更新主机端代码以支持 Intel split k FA 内核路径选择,修复 A770 Linux 上的算子测试失

正文结构化主题已通过公开置信门槛
智东西产品发布

浪潮信息发布SD200 Ultra与HC2000,破局Agent算力

在AICC 2026大会上,浪潮信息发布元脑SD200 Ultra超节点AI服务器和元脑HC2000多元算力机组,分别面向Agent时代算力的“向上”与“向广”需求。SD200 Ultra以128芯本土AI芯片、3D HyperMesh架构和8TB带宽、64TB内存,实现单机运行2.8万亿参数Kimi K3,Token生成时延首次突破5.85毫秒,并支持10

另有 1 家信源报道

正文结构化主题已通过公开置信门槛
智东西产品发布

海光发布1000系列CPU,C86架构进军嵌入式与端侧市场

海光信息正式发布海光1000系列CPU,基于C86架构,面向低功耗、嵌入式和端侧算力需求,具备4核8线程、10W典型TDP、-40°C至105°C宽温能力及10年产品生命周期承诺。该产品将海光在数据中心CPU、DCU领域的技术与生态积累延伸至机器人、工业控制、边缘计算等场景,并同步推进嵌入式生态合作。此举标志着国产芯片从数据中心向边缘端侧全场景扩展,增强与国

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源1

llama.cpp b11109 发布:修复 Metal 后端 MUL MAT ID 精度门控

llama.cpp 发布 b11109 版本,主要修复了 Metal 后端中 mul mm id 的 src1 重缩放逻辑,将其置于 ggml prec 门控之下。同时,ggml-webgpu、CUDA 和 Vulkan 后端在 src1 精度为 F32 时拒绝 MUL MAT ID,并修正了 supports op 的返回值。该版本还提供了覆盖 macOS

正文结构化主题已通过公开置信门槛
NVIDIA Technical Blog一手来源产品发布1

NVIDIA 机密计算实现高性能私有 AI 推理

NVIDIA 技术博客介绍其机密计算(Confidential Computing)方案,通过内存加密的机密虚拟机、机密 GPU 和加密 NVLink,让 LLM 推理在可信硬件环境中运行。文章以 DeepSeek-R1-0528-NVFP4 模型在 TensorRT LLM 上的测试为例,说明 CC 开启后输出吞吐保留 96.1%–98.2%,平均 TPO

正文结构化主题已通过公开置信门槛
NVIDIA Technical Blog一手来源开源1

NVIDIA 开源 Topograph:面向 AI 工厂的拓扑感知工作负载调度

NVIDIA 发布开源工具包 Topograph,用于发现集群网络拓扑并将其标准化为 Kubernetes 节点标签、Slurm 配置、Slinky ConfigMap 等调度器可识别的格式。它通过 API Server、Node Observer、Node Data Broker、Provider 和 Engine 五个组件保持拓扑视图实时更新,并与 DR

9月22日周二 · 11 条
正文结构化主题已通过公开置信门槛
量子位商业

Agent时代CPU价值重估:英特尔称CPU与GPU配比趋近1:1

英特尔在苏州技术创新与产业生态大会上提出,Agent时代AI计算配比正从CPU与GPU的1:4趋近1:1,CPU需承担更多调度、数据处理与任务编排工作。英特尔介绍了至强处理器的数据预处理加速、KV Cache无损压缩与存储优化方案,并强调与Linux、PyTorch等开源项目及国内软件伙伴的合作。大会还提及端侧CPU、GPU、NPU协同及家庭AI、车载AI、

正文结构化主题已通过公开置信门槛
NVIDIA Technical Blog一手来源教程

NVIDIA 为 ROS 2 贡献 CUDA buffer 后端并演示 AI 代理迁移节点

NVIDIA 在 ROS 2 Lyrical 中贡献了 CUDA buffer 后端,配合上游 rosidl::Buffer 抽象,让 ROS 2 节点在满足同主机、同 CUDA 设备、同 Linux 用户及受支持 RMW 实现等条件时,可通过零拷贝传输交换 GPU 常驻数据,否则自动回退到 CPU 路径。NVIDIA Isaac ROS 5.0 的所有节点

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

微步联合宏碁发布全球首款799g 14英寸x86笔记本

深圳ODM厂商微步在IFA 2026上联合宏碁发布全球首款799g的14英寸x86笔记本Swift Blade 14,采用碳纤维+镁铝合金复合壳体与高密度主板堆叠方案,在极轻机身内保留50Wh电池和完整Type-C接口。此前800g以内的14英寸轻薄本仅有华为MateBook Pro S(798g,镁锂合金全金属路线)做到,而微步走开放式ODM平台路线,将1

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

智锐通发布 EMA-7132 双 PCIe 医疗影像主板

智锐通发布 EMA-7132 Mini-ITX 主板,采用 170×170mm 标准尺寸并板载双 PCIe 插槽,使图像采集卡与 AI 推理显卡可同板并行工作。该主板搭载 Intel Alder/Raptor Lake-H i5/i7/i9 处理器,支持 DDR5 内存,可在设备端完成数据分析,并支持三路独立显示与四路 2.5GbE 网口。产品面向内窥镜手术

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源

llama.cpp b11095:Hexagon HMX 优化 GATED DELTA NET

llama.cpp 发布 b11095 版本,主要新增针对高通 Hexagon 平台的 HMX 优化版 GATED DELTA NET(GDN)内核。该 PR 逐步实现了 HMX 支持、流水线化 HMX 与 DMA、HVX 多线程、向量化 expf 及尾部处理优化,并改进了 flash attention 内联 softmax 与 DMA 流水线,使 tok

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源

llama.cpp 发布 b11093:修复 Metal flash attention mask 边界

llama.cpp 发布 b11093 版本,主要修复了 Metal 后端 flash attention 块预处理阶段的 mask 边界问题(PR #29220)。该版本同时提供覆盖 macOS/iOS、Linux、Windows、Android 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVI

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源

llama.cpp b11090:修复 CUDA sm 70 tile 编译错误

llama.cpp 发布 b11090 版本,主要修复了 CUDA 后端在 sm 70(Volta 架构)上的 tile 编译错误。此前提交 1884824fd 引入的五参数 load ldmatrix 仅定义了 tile ,导致 Volta 的 tile 无法匹配;本次将 tile 形状泛化为 ,使非 swizzle 分支可转发到三参数加载器。该修复由 D

正文结构化主题已通过公开置信门槛
智东西产品发布

宇树发布新款五指灵巧手Dex5-S,3.99万元起

宇树科技发布新款五指灵巧手Dex5-S,单手拥有22个自由度,采用与真人手1:1的尺寸设计,售价3.99万元起。该产品在演示中展示了拿取勺子、使用剪刀裁纸、抛接柠檬等精细操作能力,22个电机均支持直驱、反向驱动和双编码控制,并新增小拇指roll自由度。Dex5-S单手负载可达2kg,配备冲击保护结构和精密微型减速器,支持15V-65V宽电压及千兆网口、USB

正文结构化主题已通过公开置信门槛
智东西商业

2026全球AI芯片峰会上海落幕:智能体时代CPU回归与3D存算成焦点

2026全球AI芯片峰会在上海落幕,由智东西发起、智猩猩主办,超过60位嘉宾围绕架构创新、3D堆叠、存算一体、HBF新型存储、智能体推理等议题展开分享。英特尔高宇提出智能体时代CPU重回C位,并预告将展示单机柜承载5万Agent的高密度CPU机柜;后摩智能、奎芯科技、东方算芯、亿铸科技等企业分别披露3D CIM、定制内存、软件定义芯片、通用存算一体等进展。大

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源

llama.cpp 发布 b11075:简化 ggml-metal 融合算子声明

llama.cpp 发布 b11075 版本,主要改动是简化 ggml-metal 后端中融合算子(fusion pattern)操作列表的声明方式,从 ops all 派生非空融合算子并去掉模式向量中的 all 后缀。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROC

正文结构化主题已通过公开置信门槛
NVIDIA Generative AI Blog一手来源商业

埃及AI生态迈向规模化,英伟达加速非洲算力布局

英伟达在埃及大埃及博物馆举办活动,展示埃及AI生态从赋能走向规模化落地,英伟达高管发表演讲并组织初创企业圆桌。埃及的英伟达深度学习学院学员一年内增长超十倍,Hassan Allam数据中心获牌照并计划投资约4亿美元建设数据中心。非洲AI基础设施快速扩张,多个AI工厂宣布或上线,Cassava、Stratos Lab、Nexus Core Systems等推进

9月21日周一 · 3 条
正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源

llama.cpp b11073:SYCL 合并 MKL-FA softmax 加载

llama.cpp 发布 b11073 版本,主要变更是 SYCL 后端对 MKL-FA softmax 加载进行合并(coalesce),替代原先每行一个 work-item 的实现方式,并改进了变量命名可读性。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译包,覆盖 CUDA、Vulkan、ROCm、SYCL、Ope

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源

llama.cpp b11071 发布:Ubuntu CUDA 构建升级至 13.4

llama.cpp 发布 b11071 版本,主要变更是将 Ubuntu CUDA 发布构建的 CUDA 版本升级到 13.4(PR #29202)。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,涵盖 CPU、Vulkan、CUDA 12/13、ROCm、OpenVINO、SYCL 等后端。

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源开源

llama.cpp b11070:Hexagon 后端 DMA 与 64 位映射重构

llama.cpp 发布 b11070 版本,主要针对 Hexagon 后端进行大规模重构,重写缓冲区和 DMA 处理以支持 64 位映射。改动涵盖二进制算子、softmax、GDN、矩阵乘法等内核的 DMA 化,并新增检查脚本与开发者文档。同时提供 macOS、iOS、Linux(含 CUDA、ROCm、Vulkan、SYCL 等)及 Android 多平