识别却无法生成:文化特定亲属称谓生成基准
该研究提出一个面向文化特定亲属称谓的生成基准,用印地语、泰米尔语和韩语测试五个开源权重模型(GPT-OSS-120B、Sarvam-M、Llama-3.3-70B、GLM-5.1、Kimi-K2.6)在生日祝福和婚礼邀请中生成亲属称谓的能力,并与同一关系-语言单元的四选一选择基线对比。结果显示模型选择正确称谓的比例远高于生成比例,例如GPT-OSS-120B
公司与模型 · 智谱的 GLM 系列模型动态:旗舰开源发布、代码与推理能力迭代、商业化与生态
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14
该研究提出一个面向文化特定亲属称谓的生成基准,用印地语、泰米尔语和韩语测试五个开源权重模型(GPT-OSS-120B、Sarvam-M、Llama-3.3-70B、GLM-5.1、Kimi-K2.6)在生日祝福和婚礼邀请中生成亲属称谓的能力,并与同一关系-语言单元的四选一选择基线对比。结果显示模型选择正确称谓的比例远高于生成比例,例如GPT-OSS-120B
智能经济30人论坛AGI测评中心发布2026年9月12日至18日《AGI市场观察》,基于OpenRouter词元消耗、厂商官方价格及Arena基准测评追踪国产大模型。报告显示,DeepSeek V4 Flash、V4.1 Flash、腾讯Hy4 preview、智谱AI GLM 5.3 Flash四款轻量级模型周用量均破10万亿tokens,四强合计约占中国
OceanBase团队提交的Data Agent方案Scout在国际数据智能体基准DAB上以90.62%准确率登顶,成为首个突破90%的参评方案。该方案基于国产大模型GLM-5.2构建,超过多项基于GPT、Claude Opus、Claude Fable等海外模型的方案。方案通过DataLens数据画像、执行路径规划与证据追踪校验形成闭环,相关能力将融入Oc
另有 1 家信源报道
雷峰网报道称,2026年国内云厂商为冲刺MaaS收入,将销售人均MaaS指标推高至千万元级,并数周内要求日均Token收入翻数倍,导致某区域团队十几人集体离职,被内部定性为管理事故。由于自研模型竞争力不足,销售转向转售智谱、Seedance等第三方模型,引发国产模型折扣战与云资源券补贴,Codex的额度重置机制又进一步截走客户预算。文章还描述了销售在批折扣、
智谱于9月13日晚间公告完成约50亿美元融资,包含约20亿美元股份配售及约30亿美元可转债发行,资金主要投向模型研发与算力基础设施。文章梳理了智谱从GLM-4.6到GLM-5.3约两个月一次的迭代节奏,以及上半年收入9.54亿元、同比增长399.7%的商业化进展,并分析其下一代GLM研发、完全自训练(Fully Self-Training)路线与国产算力布局
智谱在港交所公告配售新H股并发行201.4亿元人民币零息可转债,合计预计净募约393亿港元,上市不到九个月累计净募约755亿港元。约60%资金将投入下一代GLM基础模型和“完全自训练”体系研发,该体系被定义为递归式自我改进闭环,涵盖数据自产、环境自造、基础设施自我优化三个维度。公告还预告GLM-6.0将提升有效规模、原生多模态统一建模和长程任务强化学习能力,
智谱宣布完成约50亿美元(约合人民币335.4亿元)融资,包括约20亿美元股份配售及约30亿美元零息可转债,资金约60%用于下一代GLM基础模型与完全自训练体系研发,重点探索递归式自我改进(RSI)循环。公司披露2026年上半年营收9.54亿元、同比增长近400%,MaaS及API收入8.25亿元,ARR达16亿美元。此举反映国产大模型头部厂商融资与上市竞赛
国产大模型企业智谱正式登陆天猫开设官方旗舰店,销售Coding Plan等订阅套餐,开店48小时品牌搜索量暴涨50倍,带动AI token类产品成交环比增长超160%。天猫通过标准化规范和推荐机制帮助大模型厂商触达更广泛用户,MiniMax、Kimi等厂商也有望跟进。此举标志着大模型从官网直销转向电商渠道,从技术厂牌向消费品牌转型,电商销量和复购或成为衡量A
雷峰网对智谱最新旗舰模型GLM 5.3进行了实测,通过让其与GLM 5.2开发同一款基于OpenStreetMap数据的北京驾驶游戏,发现GLM 5.3在开发效率、真实感和工程组织能力上更优,但因其更强的安全策略,在自动化工具链中更易触发拒绝判断,导致流程卡顿。
智谱AI发布了GLM-5.3-Flash原生多模态模型,该模型具备视觉能力,能主动观察界面、渲染与交互反馈,实现代码、浏览器与图形界面的协同闭环。模型采用线性注意力与稀疏注意力混合架构,总参数320B,激活18B,计算量与KV缓存较GLM-5.3大幅降低。此外,该模型拓展至Office文档与金融研究工作流,能自主拆解复杂目标、调用工具并优化输出。
另有 1 家信源报道
雷峰网早报汇总了多项AI行业动态:宇树科技科创板上市首日股价暴涨,创始人王兴兴表情平静;豆包大模型正式上车特斯拉;字节跳动Seed基模团队调整组织架构;智谱发布GLM-5.3 API并计划开源;OpenAI第二季度营收67亿美元,增速不及Anthropic。
本文以GLM-5为例,探讨九章智算云如何通过强化学习系统实现训推一致。文章指出,随着预训练边际收益递减,模型能力Scaling正转向后训练强化学习,RL成为模型能力持续提升的关键。九章智算云通过将Generator、Environment和Trainer纳入统一工作流,实现动态调度和状态资源化,提升有效Token产出率,并与模型厂商形成算法与基础设施双向RL
智谱AI发布了新一代旗舰模型GLM-5.3,其编程能力大幅提升,在内部基准上较GLM-5.2提升50%,并在公开测试中达到开源模型SOTA水平。该模型还展现出网络安全能力,在漏洞发现方面与Mythos 5持平,已联合多个中国安全团队测试并发现2436个漏洞。
智谱AI于8月14日发布新一代开源模型GLM-5.3,总参数量7430亿,能力提升源自后训练强化学习,编程能力提升50%,在多个基准测试中位列开源模型第一。同日,范式旗下统一模型调用平台PhanRouter完成适配并开放调用,成为首批支持该模型的平台之一,用户无需更换API地址即可直接调用。PhanRouter提供统一API、智能路由和缓存优化,兼容多款国产
智谱发布GLM-5.3模型,在基座不变的情况下,通过后训练技术使编程能力提升50%,并宣称在安全领域发现2436个漏洞,包括潜伏40年的DNS协议漏洞。该模型在多个评测中逼近或超越Claude Fable 5,并开源,同时推出编程工具ZCode和AutoClaw。
中国AI初创公司智谱AI发布了GLM-5.3模型,声称其是最强大的开源权重编码模型,所有改进均来自扩展的后训练。该模型在基于代理的任务上表现突出,并在网络安全方面通过训练发现软件漏洞,共发现2436个漏洞。GLM-5.3现已通过GLM编码计划提供,权重将在两周后开源。
智谱今日发布GLM-5.3模型,在Coding能力上接近Claude Fable 5,并成为最强开源安全模型。该模型在CyberGym白盒代码审查中得分84.5%,高于前代及GPT-5.6 Sol。智谱联合清华、南开等机构进行了密集红队测试,累计发现2404个漏洞,其中1088个为中高危。实测显示GLM-5.3能完成可交付的模拟游戏开发,并能自主发现、修复安
本研究通过进化迭代囚徒困境实验,比较了四款中国前沿大模型(DeepSeek V4 Pro、Qwen3-Max、Kimi K2.5、GLM-5.1)的合作倾向。研究发现,这些模型并非铁板一块,实验室间差异显著,且中国模型内部的差异大于中国与西方生态系统之间的平均差异。研究还发现,中国模型的合作倾向普遍性较弱,但这一结论受转换器选择影响。
本期早报涵盖AI行业多项动态:DeepSeek招聘土木工程师并组建Harness团队,拓展算力基础设施与代码智能体;原阿里千问负责人林俊旸创立语用科技,获腾讯等投资,聚焦下一代AI智能体;宇树科技公布中签结果;Manus将恢复独立运营;OpenAI前机器人业务负责人加入Anthropic;智谱ZCode用户破百万并上线新功能。
Hugging Face 披露了一起由自主 AI 代理系统驱动的安全事件,攻击者以机器速度执行了数万次自动化操作。在分析过程中,商业 API 的前沿模型因安全护栏阻止了恶意负载分析而失败,最终 Hugging Face 使用自托管的开源模型 GLM 5.2 完成了取证分析,并避免了数据外泄。文章建议企业安全团队预先部署自托管模型作为后备,并介绍了通过戴尔、微