梁文锋CFO到位!投过智谱MiniMax
路透援引知情人士消息称,DeepSeek计划聘请高瓴创投合伙人严文韬担任公司首任CFO。严文韬1991年生,曾投资字节跳动、小红书、极兔、MiniMax、智谱等项目。此前DeepSeek于2025年2月挂出CFO岗位但长期空缺,今年7月重启招聘并密集面试头部VC年轻合伙人。报道还提及DeepSeek已聘请中信证券筹备科创板IPO,最早今年年底递交申报材料,力
公司与模型 · MiniMax 的模型与产品动态:M 系列大模型、语音与多模态能力、开源与商业化
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-24 14:40
路透援引知情人士消息称,DeepSeek计划聘请高瓴创投合伙人严文韬担任公司首任CFO。严文韬1991年生,曾投资字节跳动、小红书、极兔、MiniMax、智谱等项目。此前DeepSeek于2025年2月挂出CFO岗位但长期空缺,今年7月重启招聘并密集面试头部VC年轻合伙人。报道还提及DeepSeek已聘请中信证券筹备科创板IPO,最早今年年底递交申报材料,力
RunningHub 开源了 MiniMax H3 视频生成加速方案 H3 Lightning,通过 RH 后训练加速模型将生成步数从 50 步压缩至 9 步,并叠加 SageAttention2、Cache-DiT、torch.compile 及 TP2+Ulysses4 多卡并行优化,在 4 张 RTX 6000D 上把 5 秒视频生成耗时从 348.8
另有 1 家信源报道
国产大模型企业智谱正式登陆天猫开设官方旗舰店,销售Coding Plan等订阅套餐,开店48小时品牌搜索量暴涨50倍,带动AI token类产品成交环比增长超160%。天猫通过标准化规范和推荐机制帮助大模型厂商触达更广泛用户,MiniMax、Kimi等厂商也有望跟进。此举标志着大模型从官网直销转向电商渠道,从技术厂牌向消费品牌转型,电商销量和复购或成为衡量A
Fal 对 Minimax 的 H3 模型进行后训练和推理优化,实现了 35 倍速度提升,突破了实时视频生成的瓶颈,并推出了无限视频流服务。该服务因内容质量低被 Twitch 和 YouTube 下架,但 Fal 自建平台继续运营。文章认为这标志着更快实时视频生成的可能性,对 AI 行业具有前瞻意义。
英特尔联合MiniMax、数字折叠举办AIGC创作研讨会,展示锐炫Pro B70显卡在本地AI视频生成中的应用,强调其32GB显存和Day 0适配H3模型的能力。英特尔旨在通过简化部署流程和构建多卡生产线,将自身嵌入本地AIGC生态,抓住创作者从云端转向本地算力的趋势。
英特尔在广州举办AIGC创作研讨会,联合MiniMax和数字折叠展示了基于锐炫Pro B70专业级显卡的本地化AI视频制作全流程方案。该显卡具备32GB显存和367 TOPS算力,支持从剧本到成片的完整流程,并适配开源模型MiniMax H3。此举旨在降低AI短剧创作的门槛和成本,推动本地算力与创作工作流的协同。
OpenAI首席科学家Jakub Pachocki表示,未发布的Astra模型已达到其2026年9月设定的“自动化AI研究实习生”目标,而Sama在《时代》采访中估计OpenAI将在2026年12月内部宣布实现AGI。此外,Hugging Face与Pollen Robotics联合推出399美元的开源双足机器人Microduck,支持模拟训练和强化学习定制
Agno 发布了 v3.0.0a4 版本,包含多项功能改进和修复。主要更新包括:SqliteDb 启用 WAL 日志模式、新增 MiniMax 视频生成工具、所有遥测调用改为即发即忘模式、强化 Workspace 排除模式作为访问边界,并进行了 v3.0 发布准备,将数据库套件纳入 CI。同时修复了测试安装、首次发布版本保护等问题,并发布了 agnoctl
Hugging Face 2026年夏季报告显示,开放模型数量持续增长,但下载分布极不均衡。中国实验室在超大模型发布上领先,而美国硬件公司如AMD和NVIDIA成为开源模型发布主力。下载量与点赞量反映不同价值,前沿模型受关注但小模型被广泛使用。
SGLang 发布 v0.5.17 版本,包含 582 个 PR,来自 194 位贡献者。主要亮点包括对 Kimi K3 和 MiniMax-H3 的 day-0 支持,以及新的 DCP 通信后端、DWDP 预填充策略、会话感知的 Radix Cache 等性能优化。此外,还新增了多个模型支持,并提升了引擎恢复速度和降低了主机开销。
realrebelai 在 Hugging Face 上发布了 MiniMax-H3 模型的 GGUF 量化版本,支持文本到视频生成,并提供了 ComfyUI 的目录结构。该模型基于 Comfy-Org/MiniMax-H3,包含 UNet、文本编码器和 VAE 组件,用户需从 Comfy-Org 获取 VAE 文件。发布者声称已获得 MiniMax 的许可
Together AI 推出了 Provisioned Throughput 服务,为前沿开放模型提供预留推理容量,采用基于 token 的定价和 99% 可用性 SLA。该服务允许客户购买 PTU 单位,以固定速率保证吞吐量,成本比 Claude Opus 4.8 低 90%。目前支持 MiniMax M3 和 GLM-5.2,覆盖北美和 EMEA 地区。
Spring AI 发布了 2.0.0-RC1 版本,包含多项新特性、错误修复和文档更新。新特性包括为 MessageWindowChatMemory 添加回合边界裁剪、移除模型默认值、将 advisors 移至独立模块、移除内部工具执行等。错误修复涉及流式处理、span 层级和 JSON schema 生成等问题。该版本旨在简化 API 并提升可维护性。
RAGFlow 发布 v0.25.5 版本,新增本地与 SSH 数据源支持,并优化数据集搜索路径,延迟降低 50-100%。该版本还改进了元数据过滤、TTS 缓存、服务器启动速度等性能,并修复了多项安全与功能问题。
LlamaIndex 发布 v0.14.19 版本,包含多个包更新。核心修复包括在 BaseIndex.delete ref doc 中传递 delete from docstore 参数、保留 SQLDatabase.run sql 中的 CTE 名称、对齐同步检索去重键等。新增 MiniMax LLM 集成(默认 M2.7)、支持 GPT 5.4 Min
百度千帆平台在2026年2月13日更新,新增GLM-5、Kimi-K2.5、MiniMax-M2.1深度思考模型,并支持自主规划Agent一键发布为秒哒插件,同时上线OpenClaw快速体验页面,新用户部署成功可获200元代金券。此外,工具广场推出AI论文功能,由百度文库、网盘与千帆团队联合打造,可一键将大纲扩展为高质量正文,提效50%以上。