百融硅基员工批量上岗,AICC业务增长52%
百融智能发布2026年中报,总收入下降但AICC业务同比增长52%,新场景收入增长195%。公司推出硅基员工,在物流和券商场景中部署,采用按结果收费的RaaS模式,并计划通过技术重构型AI Roll-up战略扩大业务。
公司与模型 · Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 08:14
百融智能发布2026年中报,总收入下降但AICC业务同比增长52%,新场景收入增长195%。公司推出硅基员工,在物流和券商场景中部署,采用按结果收费的RaaS模式,并计划通过技术重构型AI Roll-up战略扩大业务。
OpenAI 公布了即将推出的 Astra 模型的新细节,称其为首个达到其“关键网络安全阈值”的大语言模型,能够自主发现并利用系统漏洞。OpenAI 计划很快发布 Astra,但对最先进的网络安全功能将限制访问,并已采取多项安全措施,包括改进模型防护、限制高风险账户、增加思维链监控等。然而,由于缺乏第三方确认,外界难以评估其安全声明。
Nous Research 发布了 Hermes Agent v0.21.0,代号 Pantheon,优化了 Bot Mode,支持多 Agent 群聊、独立身份、@召唤和任务中断。更新合并了约 2475 个 PR,新增持久记忆、子 Agent 纠偏和 MCP 优化,同时加强了安全机制并撤回两个不成熟功能。社区反响热烈,认为其可能取代 Grok Bot,但存
Empirik 是一家由 Sequoia Capital 孵化的初创公司,专注于利用 AI 预测基础设施故障,于周二宣布获得 2100 万美元种子轮融资,投资方包括 Sequoia、Canapi 和 Alumni Ventures。该公司的产品通过跟踪系统变更并推断其潜在影响,帮助 DevOps 和 SRE 团队预防中断。Empirik 已拥有包括 S&P
AI 安全初创公司 AIR 宣布获得 5000 万美元融资,用于构建监控 AI 代理所用技能、插件和 MCP 服务器的平台。该公司由以色列 8200 部队退伍军人创立,提供代理发现、持续审查和拦截功能,目前已有 20 多家客户。融资由 Sequoia 和 Greenoaks 领投,资金将用于招聘和拓展市场。
llama.cpp 发布 b10737 版本,主要针对 qwen4exp 架构进行修复,包括序列并行、块位置键控、多模态输入、CUDA 中止等问题,并新增了序列状态保存/恢复的测试。该版本还禁用了 qwen4exp 的 -sm tensor 支持,并提供了 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件。
InfoQ 宣布其在线认证项目九月班次开放报名,涵盖架构、工程领导力和 AI 辅助工程三个方向。每个项目为期五周,每周一次四小时的在线课程,参与者通过观看 QCon 演讲并应用框架到实际工作中来获得认证。AI 辅助工程课程由 Thoughtworks 专家授课,强调构建验证框架,使用 Claude Code 进行实践。
雷峰网报道,2026年中国AI应用创业公司面临模型能力快速升级和大厂竞争的双重压力,被形容为“在流沙上盖房子”。文章以Lovart、Genspark和Flowith为例,分析了三种应对路线:深入专业工作流、扩大任务边界、构建长期工作系统。创业者陈冕、景鲲和倪正民分别做出不同选择,但都面临模型升级可能吞噬应用层价值的挑战。
雷峰网对DeepSeek Harness插件生态进行了全面调查,发现其1.1万个插件中仅不到1000个可用,官方缺乏治理机制,包括无插件目录、无安全校验等。调查还发现插件权限形同虚设,存在安全风险,且生态中充斥着大量无关或低质量插件。文章指出DeepSeek将工程制品当作产品发布,导致用户需自行承担安全责任,生态可能被老玩家占据。
雷峰网发布万字长文,拆解DeepSeek V4 Pro与Harness框架。文章通过实测发现,V4 Pro在Terminal Bench等agentic任务上大幅提升,但相比Flash性价比不高,且其1M上下文是通过YaRN外推实现,但实测未衰减。DeepSeek通过缓存优化和定价策略控制成本,并开源Harness框架,强调后训练成为旗舰模型升级主战场。
雷峰网对智谱最新旗舰模型GLM 5.3进行了实测,通过让其与GLM 5.2开发同一款基于OpenStreetMap数据的北京驾驶游戏,发现GLM 5.3在开发效率、真实感和工程组织能力上更优,但因其更强的安全策略,在自动化工具链中更易触发拒绝判断,导致流程卡顿。
开源项目Archify登上GitHub热榜,它能用AI一键生成美观且支持实时更新的架构图,兼容Claude Code、Codex等Agent。开发者“也无风雨也雾晴”是专升本出身,曾因学历在求职中屡遭挫折,后通过开源作品证明自己并获大厂Offer。Archify通过生成JSON IR并验证渲染,支持多种图表类型和交互功能,旨在解决AI生成架构图准确性问题。
LiteLLM 发布 v1.99.0 版本,所有 Docker 镜像均使用 cosign 签名,并提供了通过提交哈希或发布标签验证签名的方法。该版本包含多项修复和功能更新,涉及类型检查、代理 WebSocket 透传、Bedrock 批量任务取消、MCP OAuth UI 恢复、Azure Content Safety 防护等。
MoziAI-35B-V3.8 是由中国金融领域意见领袖陈雨墨团队开发的开源多模态 AI 模型,基于 Ornith-1.5-35B-A3B 基础模型,采用 MoE 架构,通过自研 MoziSmartBit 量化压缩至 15.9GB,支持本地部署和免费商用。模型具备动态七维思考框架、Agent LOOP 迭代机制、金融垂直优化和无审查特性,支持多语言、视觉理解
筷子科技发布视频商业AI能力统一价值单位“KP”及企业“KP钱包”,旨在统一管理模型调用、内容生产、分发等环节的预算与能力。KP建立在Token之上,覆盖模型、算力、Agent、工具等资源,企业可通过KP钱包分配预算并管理多业务环节。目前Kuaizi已积累超1.2亿条商业视频,服务13500多家付费企业,并展示了多个客户效率提升案例。
该研究提出概率依赖图(PDG)表示法,将贝叶斯网络结构学习(BNSL)与大型语言模型(LLM)的因果知识进行概率融合。在26个基准网络上,将三种BNSL算法与三种LLM结合,50/50融合在22个网络上优于单一来源,平均F1显著提升。分析显示BNSL提供高召回率的边骨架,而LLM提供高准确率的边方向,两者互补。
该研究首次在完整的Jeopardy!题库(1984-2025年,529,939条线索)上评估了单个9GB开源模型(Qwen2.5-14B,4位量化),严格强制回答下准确率达67.0%,事实类类别超过85%。研究对比了IBM Watson,指出训练数据暴露是两者共有的,但本地模型在训练截止后的线索上仍保持65%准确率,而Watson为0%。作者认为知识压缩能力
AWS 宣布 Agent Registry 正式可用,这是一个用于大规模管理 AI 代理、工具和技能的统一目录服务。该服务提供治理平面和发现平面,支持 MCP、A2A 等资源类型,并具备语义搜索、访问控制和审批流程。索尼、三菱电机和西南航空等公司已开始使用该服务,以解决代理发现、治理和运营挑战。
llama.cpp 发布 b10724 版本,优化了 KV 缓存状态恢复时非连续单元格的散列读取性能,通过按连续运行批量复制,将恢复时间从 25-63 秒降至 221-424 毫秒,并增加了相关测试。
Strands Agents SDK 发布了 typescript/v1.16.0 版本,新增了后台任务、MCP v2 兼容、BM25 全文搜索等功能,并修复了多项问题。该版本还包含文档更新和依赖升级,旨在提升 SDK 的功能性和稳定性。