苹果发布M6/M5 Pro Mac mini及Mac Studio,AI性能大幅提升
苹果发布新款Mac mini和Mac Studio,Mac mini首发2nm M6芯片,AI性能大幅提升,Mac Studio搭载M5 Max/Ultra芯片,支持本地运行大模型。同时,苹果与阿里巴巴联合训练面向中国市场的AI大模型,推进Apple智能落地。此外,苹果计划在9月发布折叠屏iPhone等新品。
公司与模型 · DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与能力的搅局者
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 19:03
苹果发布新款Mac mini和Mac Studio,Mac mini首发2nm M6芯片,AI性能大幅提升,Mac Studio搭载M5 Max/Ultra芯片,支持本地运行大模型。同时,苹果与阿里巴巴联合训练面向中国市场的AI大模型,推进Apple智能落地。此外,苹果计划在9月发布折叠屏iPhone等新品。
OpenAI 发布新款 AI 芯片 Jalapeño,宣称其推理性能优于 Nvidia 的 GB200/GB300 超级芯片,能效提升 1.5 至 1.9 倍,端到端延迟降低 1.7 至 3.6 倍。该芯片由 OpenAI 与 Broadcom 合作设计,专为 AI 推理优化,计划于今年年底小规模部署,2027 年扩大规模。OpenAI 表示不会完全替代现有
另有 2 家信源报道
英伟达宣布其推理加速器Groq 3 LPX进入全面生产,该芯片针对AI代理的快速token生成进行了优化。在Artificial Analysis的基准测试中,该系统达到每秒3400个token,英伟达称其速度是竞争对手Cerebras的四倍。然而,专家指出该对比对英伟达有利,因为其架构需要至少64个芯片才能达到该结果,而Cerebras仅需一到两个加速器。
DigClaw公司的预测框架Rhizome v1在FutureX评测平台上获得三个前十席位,验证了预测能力可独立于基座模型。该框架通过搜索与推理解耦、轨迹记录与概率校准、因果链感知更新三大设计,降低了过度自信率。DigClaw及其关联的Newborn Ventures将这一能力应用于投资决策,并计划向产业方、金融机构和政府引导基金开放服务。
NVIDIA 发布了 Spectrum-X 以太网架构,专为大规模 AI 工厂设计,通过硬件加速的交换机和网卡协同设计,解决传统以太网在 AI 训练中的瓶颈。该架构采用自适应路由、硬件拥塞控制和平面负载均衡,在多租户场景下将训练步进时间稳定在 668 毫秒,而传统以太网在噪声流量下延迟至 1.18 秒。这显著提升了 AI 训练的性能和隔离性。
NVIDIA 技术博客介绍了 SemiAnalysis 的 AgentX 基准测试,用于评估 AI 基础设施在代理式编码推理中的性能。该基准通过重放真实编码代理会话,测量每兆瓦吞吐量等指标。NVIDIA 公布的预览结果显示,Vera Rubin NVL72 在 AgentX 工作负载下每兆瓦吞吐量比 GB300 NVL72 高出 30 倍,而 GB300 N
llama.cpp 发布 b10610 版本,主要更新为缩短 CUDA 和 Metal 后端中虚拟设备的命名,并优化了 Metal 设备描述在初始化时的构建。该版本提供了适用于 macOS、Linux、Windows、Android 等多平台的预编译二进制文件,涵盖 CPU、Vulkan、CUDA、ROCm、OpenVINO、SYCL 等后端。
中诚华隆在北京发布HL200推理芯片及超节点智算集群方案,实现从单芯片到万卡集群的体系化突破。HL200支持FP4/FP8超低精度推理,能效比达5.12 TFLOPS/W,兼容主流技术栈,并在DeepSeek V4等模型测试中性能领先。公司同时与多家企业达成战略合作,推动国产推理算力生态建设。
这篇综述论文系统梳理了“Vibe Coding”(AI辅助软件开发)的实践、性能、生产力和风险。研究发现早期基准测试已饱和,但任务级能力不均衡,如代码生成可靠而故障检测薄弱。生产力证据看似矛盾,但通过统一测量方法可解释,并指出收益在新代码上真实,在成熟代码库上可能缩小或逆转。
RayNeo 发布新款 AI 眼镜 RayNeo iO,无摄像头和扬声器,通过绿色波导显示屏在视野中叠加文字,透明度 97%,亮度约 1300 尼特。眼镜可监听对话、总结内容、提取行动项并建议日历条目,用户可通过点头确认,还支持提词器模式和 40 种语言的语音转文字翻译。设备内置四个麦克风和骨传导传感器,麦克风激活时 LED 亮起。出厂预装 RayNeo A
Latent Space 的 AINews 文章提出,自 2022 年以来,AI 流水线中越来越多的组件从人类制造转向模型制造,形成“模拟”趋势:性能略差(10%),但成本更低(100 倍)且速度更快(10000 倍)。文章按阶段梳理了从奖励信号、训练数据、教师模型、课程设计到研究者、环境乃至人类主体的合成化进程,并引用 InstructGPT、Phi、Al
SGLang 发布 v0.5.18 版本,包含 710 个 PR,来自 212 位贡献者。新增支持 Muse Glimmer、Intern-S2-Mobius、SANA-Video、LingBot-Video-MoE、LTX-2.5、Cosmos3 Edge & Distilled、LongCat-Image 等模型,并优化了启动性能、LMHead 通信和缓
雷鸟发布iO AI眼镜,重34克,续航两天,搭载DeepSeek和千问大模型,支持全天候记忆、翻译等功能,售价2499元起。产品无摄像头和扬声器,聚焦知识、表达和记忆场景。同场还发布V4 AI拍摄眼镜32GB版本,售价1999元。
Spring AI 发布 2.0.1 版本,包含多项新功能和错误修复。新功能包括支持 OpenAI 音频流、可配置工具调用限制、Google GenAI 的 ToolChoice 支持、Google 图像生成支持等。错误修复涉及 Redis 聊天内存、PDF 文档读取、OpenAI 流关闭等问题。该版本还移除了弃用的 Mistral AI 聊天模型,并更新了
llama.cpp 发布 b10549 版本,主要更新是启用了 LFM2 和 LFM2MOE 模型的张量分割功能,该功能由 deepseek-v4-flash 辅助实现。同时提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件,并附带了 UI 包。部分平台构建(如 KleidiAI、ROCm 等)被标记为禁用。
雷鸟创新发布全新雷鸟iO系列AI眼镜,主打轻至34g的日常佩戴设计、两天续航及全天候主动式AI功能,支持DeepSeek V4 Pro等大模型,并强调隐私保护。该产品定价1996元起,旨在推动AI眼镜从尝鲜品走向大众日常使用。
阿里最新财报显示,阿里云营收达487.37亿元,同比增长45%,经调整EBITA同比增长133%,利润率升至11.6%。增长主要来自AI算力需求激增和MaaS收入增加,同时自研芯片出货和全栈优化提升利润。阿里全栈AI布局使其在商业化中更具优势,云厂商成为AI浪潮中的受益者。
PydanticAI 发布了 v2.32.2 版本,主要包含多项 bug 修复:修复了 pydantic evals 任务中异步可调用实例的等待问题、实时会话中 RunContext.cancel() 的问题、识别 m.youtube.com 的 VideoUrl、规范化 DeepSeek Responses 函数调用重放,以及让废弃的 TemporalAg
企业支出管理平台 Ramp 推出了自己的 AI 模型路由服务 Router,允许用户和公司通过 API 使用和切换多种大语言模型。该服务目前仅在美国可用,2026 年剩余时间内免费,并提供 26 美元信用额度。Router 提供来自 OpenAI、Anthropic、DeepSeek 等多家公司的模型,并支持多种路由策略和仪表盘监控。此举旨在进入 AI 推理
开源AI基础设施公司Prime Intellect发布研究,提出多智能体Harness系统,让更便宜的开源模型承担监控和实现任务,从而降低AI自主科研成本。实验中,18个前沿模型参与nanoGPT优化器速通,开源模型Kimi K3搭配Prime Agent Harness达到2930步,超过GPT-5.6 Sol的3042步,逼近Opus 5的2920步。研