FINCHAL 金融预测挑战赛:区分运气与技能
Hugging Face 博客宣布举办 FINCHAL 金融预测挑战赛,这是一场 AI 与人类交易员的竞赛,涉及 NVIDIA、比特币、黄金和石油四种资产,总奖金 2000 美元。该竞赛旨在通过随机基准和自检评分代码来区分运气与技能,并允许 AI 代理与人类平等参与。竞赛采用仓位连续值(-1 到 1)的评分机制,并固定杠杆为 1,以避免过度投机。
公司与模型 · 英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力供给
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 05:49
Hugging Face 博客宣布举办 FINCHAL 金融预测挑战赛,这是一场 AI 与人类交易员的竞赛,涉及 NVIDIA、比特币、黄金和石油四种资产,总奖金 2000 美元。该竞赛旨在通过随机基准和自检评分代码来区分运气与技能,并允许 AI 代理与人类平等参与。竞赛采用仓位连续值(-1 到 1)的评分机制,并固定杠杆为 1,以避免过度投机。
llama.cpp 发布 b10594 版本,主要修复了设备信息循环在非 TRACE 日志级别下仍会创建 GPU 上下文并导致 CUDA 后端分配 550 MB 显存的问题。该修复通过检查日志详细级别,在无输出时跳过设备循环,避免不必要的 GPU 资源占用。
llama.cpp 发布 b10589 版本,主要新增 CUDA 后端对 POOL 1D 操作的支持,并修复了 editorconfig 兼容性问题。该版本提供了适用于 macOS、Linux、Windows、Android 等多平台的预编译二进制文件,涵盖 CPU、CUDA、Vulkan、ROCm、OpenVINO、SYCL 等后端。
轨道数据中心初创公司 Starcloud 宣布完成 2.5 亿美元融资,使其 A 轮融资总额达到 4.2 亿美元,公司估值达 23 亿美元。资金将用于扩大制造设施并推进其最大的轨道数据中心航天器 Starcloud-3,该航天器计划搭载 SpaceX 的 Starship 火箭发射。由于发射市场紧张,公司正积极预订发射能力,并已向 FCC 申请运营 8.8
Alphabet旗下的自动驾驶子公司Waymo已开发出用于其自动驾驶出租车的定制芯片,以减少对英伟达的依赖。该芯片已在最新一代车辆中运行,能更快处理传感器数据并运行AI模型,性能超过1000 TOPS,由台积电采用5纳米工艺制造。此举旨在降低成本,Waymo正将其安装在与极氪合作打造的新款自动驾驶出租车上。
llama.cpp 发布 b10534 版本,主要更新为 CUDA 后端新增按硬件和量化类型调整的切换点,用于优化 mvq 到 MMQ 解码的交叉点。该更新引入了运行时环境变量 GGML CUDA MMVQ MAX 来调整批量大小阈值,并针对 Blackwell、Ada 等硬件进行了调优,在 RTX 5090 上 Q4 K 密集解码在 B=8 时性能提升 2
英伟达在悉尼 RSS 2026 上发布 Cosmos 3,这是一个面向物理 AI 的多模态世界基础模型,在单一 Transformer 架构下统一了文本、视觉、音频和动作模态。Cosmos 3 提供 Edge(4B)、Nano(16B)和 Super(64B)三个版本,支持世界理解、未来模拟和动作执行,并完全开源。英伟达物理 AI 专家 Max Li 在演讲
在RSS 2026大会上,具身智能领域面临物理世界落地的挑战,业界共识转向以世界模型为核心的‘想象力’驱动。Pi团队展示了零样本泛化,OpenDrive Lab提出组合式世界模型,英伟达发布全模态世界模型Cosmos 3并开源,旨在构建物理AI生态。会议凸显机器人从‘死记硬背’向‘举一反三’的转变。
llama.cpp 发布了 v0.1.2 版本,主要更新包括同步 ggml 子模块、升级 ggml 版本至 0.20.2、修复 xcframework 构建问题、优化 CUDA 性能(MMVQ nwarps=8)、改进 UI 和文档(如 MCP stdio 服务器说明)、增强 mtmd 图像处理(使用 SHA256 哈希)等。该版本还提供了 nightly
AI 芯片初创公司 Groq 宣布获得 3.5 亿美元融资,由 Disruptive 领投,Nvidia 计划参投,估值 35 亿美元,较去年 9 月的 69 亿美元有所下降。Groq 正从 AI 芯片制造商转型为提供 Nvidia GPU 和 AI 基础设施服务的 neocloud 公司,计划到 2027 年将数据中心容量从 54 兆瓦扩展到 200 兆瓦
CVPR 2026 上,3DGS 研究从追求画质转向工业落地,多篇论文聚焦前馈生成、GPU 算子重构、抗噪 SLAM 与物理碰撞推算,旨在打通全管线,使其成为具身智能与世界模型的物理底座。代表性工作包括 EcoSplat 实现算力自适应裁剪、SparseSplat 实现智能稀疏化、CaT-GS 提升大场景渲染速度、EDGS 消除高斯分裂、TokenGS 解耦
据量子位报道,前OpenAI首席科学家Ilya Sutskever创办的SSI公司被曝正在开发基于测试时训练(TTT)的小型推理引擎,该模型能在推理过程中更新权重,实现持续学习。爆料称当前版本可能于8月向少数用户开放,且英伟达已与SSI达成战略合作并投资,算力将提升10倍。若属实,这将是SSI成立两年来的首个模型,可能改变AI训练范式。
由xAI联合创始人Igor Babuschkin创立的AI初创公司River AI,在成立仅两个月后获得了由General Catalyst和AMP PBC领投的11亿美元融资,Nvidia、AMD Ventures、Y Combinator和Temasek参投。River AI旨在从头重建AI技术栈,包括训练、模型、产品层和硬件,以开发个人可训练的AI助手
英伟达CEO黄仁勋宣布与Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR等华尔街机构合作,建立独立融资平台,计划撬动超过5000亿美元第三方资本用于AI基础设施建设。黄仁勋提出AI工厂概念,将GPU算力包装为可投资的基础设施资产,并回应了循环融资的质疑。文章同时提及算力价格近期上涨,但也警示了类
llama.cpp 发布 b10353 版本,修复了 CUDA 和 Metal 后端中 ggml roll 操作对非连续输入产生错误结果的问题。该修复要求 src 张量连续,并添加了相应的测试用例。同时提供了多个平台的预编译二进制文件。
llama.cpp 发布 b10344 版本,主要新增了对 Nemotron 模型的多 token 预测(MTP)支持,并引入了 mtp flags 配置。该版本提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件,方便用户部署。
Om AI联汇完成数亿元融资,并开源全球首款端侧原生模型VLX-Seek 1.5。该模型有3B和10B两个版本,采用流式多模态架构,在无人机视角、指代表达理解等任务上超越英伟达LocateAnything等更大模型。公司旨在通过端侧原生路线,推动物理AI在机器人、无人机等场景的规模化落地。
国产GPU公司摩尔线程发布2026年半年度报告,上半年营收17.36亿元,同比增长147.42%,已超2025年全年,亏损大幅收窄。公司研发投入持续增加,旗舰产品MTT S5000实现规模化量产,夸娥智算集群在多城市部署,并完成多个大模型训练项目。公司构建了云边端全场景算力布局,MUSA生态兼容CUDA,开发者超80万。
llama.cpp 发布 b10330 版本,主要更新是在 CUDA 后端中融合了 rms norm、mul 和 rope 操作,并添加了相关测试和内存范围检查。该版本提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件。
llama.cpp 发布 b10327 版本,主要修复了 CUDA 下量化 cpy 内核启动时线程/块数量计算错误的问题,并增加了不均匀块数量的测试用例。该版本提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件,涵盖 CPU、CUDA、Vulkan、ROCm、OpenVINO、SYCL 等后端。