谷歌发布Gemini 3.8 Flash,六周内第三款预算模型
谷歌发布Gemini 3.8 Flash及其网络安全版本3.8 Flash Cyber,这是六周内第三款Flash模型。该模型在编码和智能基准上超越前代,价格与3.7 Flash持平,但推理成本更高。谷歌强调其性能提升源于额外推理步骤,并推荐效率敏感场景使用3.7 Flash。
公司与模型 · OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 01:14
谷歌发布Gemini 3.8 Flash及其网络安全版本3.8 Flash Cyber,这是六周内第三款Flash模型。该模型在编码和智能基准上超越前代,价格与3.7 Flash持平,但推理成本更高。谷歌强调其性能提升源于额外推理步骤,并推荐效率敏感场景使用3.7 Flash。
AI安全初创公司HiddenLayer在B轮融资中筹集了1亿美元,由Delta-v Capital领投,微软M12等参投。该公司过去一年年度经常性收入增长超过10倍,目前达数千万美元,客户包括国防部和情报机构。资金将用于扩展销售、工程和研究,并计划进入欧洲市场。
美国总统特朗普在Truth Social上发文,强烈反对美国国内针对AI数据中心的抗议活动,称这些抗议将让社区变得“落后和贫穷”,并有利于中国在AI竞赛中取得优势。一项盖洛普民调显示,71%的美国人反对在自家附近建设数据中心,居民担忧电费上涨、噪音和水资源消耗。研究组织Data Center Watch称,2026年第一季度,草根运动已阻止或延迟了至少75个
Adobe 已收购印度营销情报初创公司 Rilo,交易涉及许可和团队收购,具体条款未披露。Rilo 成立于 2025 年,专注于自动化营销工作流,其技术将增强 Adobe 面向大客户的现有产品。收购后 Rilo 将关闭,其六人团队和部分知识产权将整合进 Adobe。
Hugging Face 博客介绍了一个用于在对话代理中安全替换 LLM 的回放管道,该管道在生产环境下重放已批准的合成交互,仅将模型作为变量。评估了 8 个模型,其中 3 个获批,3 个因幻觉率超标被拒,但逐轮重新计算显示部分拒绝是统计平局或结构性问题。文章强调安全标准应作为独立过滤器,而非加权平均的一部分。
Anthropic 发布了 Claude Fable 5.1 和 Mythos 5.1,定位为编码和知识工作的新旗舰模型,宣称在多项基准上达到 SOTA。缓存读取价格下调 75%,但输出 token 使用量增加约 1.7 倍,导致单任务成本上升 20%。社区分析认为两个模型可能共享权重,仅安全策略不同。
另有 1 家信源报道
阿里 FunASR 发布 v1.4.13 版本,主要修复了 ONNX 运行时错误、NumPy 2 ABI 不匹配等问题,并新增了对 n8n OpenAI 音频转录的支持以及 Qwen3-ASR 的离线 vLLM 示例。该版本还提供了多平台的 llama.cpp/GGUF 运行时预编译二进制文件,方便用户快速部署语音识别模型。
该研究提出“分布式隐性危害”(DIH)概念,指多模态大模型在视频审核中无法识别由看似无害的片段组合而成的有害内容。作者构建了包含9000多个视频的DIH数据集和基准,测试30多个MLLM后发现即使最强模型检测率也低于45%,真实视频中同样失败。通过两阶段后训练,检测准确率提升超60个百分点,表明该缺陷可通过针对性训练缓解。
该研究提出一种受控基准测试,让LLM通过逐步调用工具执行MD5哈希计算,以评估其长时程状态跟踪能力。实验表明,gpt-oss-120b模型在多数运行中能正确完成全部步骤,且当用另一个LLM替代所有原始工具时,驱动-工作模型对也能从零计算哈希。成功的关键在于将模型自身推理保留在上下文中,并对工作模型采用多数投票机制。
百融智能发布2026年中报,总收入下降但AICC业务同比增长52%,新场景收入增长195%。公司推出硅基员工,在物流和券商场景中部署,采用按结果收费的RaaS模式,并计划通过技术重构型AI Roll-up战略扩大业务。
Anthropic发布了Claude Fable 5.1和Mythos 5.1模型,在8项基准测试中排名第一,价格最高降低45%。新模型在科学研究和代码任务上表现突出,并引入了反蒸馏机制,通过签名验证防止思维链被篡改。此外,Mythos 5.1在蛋白质设计、金星地形图生成和GPU加速等科研应用中展示了显著成果。
谷歌正与好莱坞多家大型电影公司洽谈,拟支付巨额费用以获取其版权内容用于训练AI模型,例如向迪士尼支付约4000万美元以获得单个角色的生成权。此举旨在提升Gemini等AI产品的公众接受度,并改变AI行业的负面叙事。然而,对电影公司而言,合作虽带来短期收益,却可能引发工人失业和公众反感,存在较大风险。
LiteLLM 发布 v1.101.0-dev.1 版本,该版本所有 Docker 镜像均使用 cosign 签名,并提供了通过提交哈希或发布标签进行验证的方法。更新内容涵盖代理性能改进、类型清理、Bedrock 和 Vertex AI 修复、OpenAI 工作负载身份联合支持、新增 /v1/responses/input tokens 端点、GigaCha
MiniMax联合fal推出视频生成模型H3 Max,生成5秒768p视频仅需不到3秒,吞吐量约为原版H3的35倍,并在Artificial Analysis和Design Arena榜单上获得图生视频第一。基于该模型,开发者们创建了实时AI直播和AI版短视频应用,实现了视频的实时生成与无缝衔接。H3 Max的开源生态已形成,衍生模型超300个,全球下载量达
雷峰网报道,2026年中国AI应用创业公司面临模型能力快速升级和大厂竞争的双重压力,被形容为“在流沙上盖房子”。文章以Lovart、Genspark和Flowith为例,分析了三种应对路线:深入专业工作流、扩大任务边界、构建长期工作系统。创业者陈冕、景鲲和倪正民分别做出不同选择,但都面临模型升级可能吞噬应用层价值的挑战。
开源项目Archify登上GitHub热榜,它能用AI一键生成美观且支持实时更新的架构图,兼容Claude Code、Codex等Agent。开发者“也无风雨也雾晴”是专升本出身,曾因学历在求职中屡遭挫折,后通过开源作品证明自己并获大厂Offer。Archify通过生成JSON IR并验证渲染,支持多种图表类型和交互功能,旨在解决AI生成架构图准确性问题。
MoziAI-35B-V3.8 是由中国金融领域意见领袖陈雨墨团队开发的开源多模态 AI 模型,基于 Ornith-1.5-35B-A3B 基础模型,采用 MoE 架构,通过自研 MoziSmartBit 量化压缩至 15.9GB,支持本地部署和免费商用。模型具备动态七维思考框架、Agent LOOP 迭代机制、金融垂直优化和无审查特性,支持多语言、视觉理解
筷子科技发布视频商业AI能力统一价值单位“KP”及企业“KP钱包”,旨在统一管理模型调用、内容生产、分发等环节的预算与能力。KP建立在Token之上,覆盖模型、算力、Agent、工具等资源,企业可通过KP钱包分配预算并管理多业务环节。目前Kuaizi已积累超1.2亿条商业视频,服务13500多家付费企业,并展示了多个客户效率提升案例。
ERR+ 提出一种两阶段 RLVR 框架,基于 token 级熵降奖励(ERR)和鲁棒相对效率奖励(RRER)优化 LLM 推理。实验表明正确推理轨迹熵降更频繁,ERR+ 在五个数据集上提升准确率并缩短响应长度。
该研究评估了大型语言模型(LLM)在UML类图建模中的表现,发现与专家设计的类图相比,LLM生成的类图存在关键类识别不完整、关系混淆或遗漏、继承关系不足、未使用类和循环依赖等问题。研究提出了记忆强化、外部知识注入和检测引导的自动修复三种策略,实验显示这些策略能有效改善模型输出,关键类识别修复率达85%,耦合关系修复率46%,继承关系修复率69%,未使用类和循