返回主题地图

智谱 GLM

公司与模型 · 智谱的 GLM 系列模型动态:旗舰开源发布、代码与推理能力迭代、商业化与生态

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 70 条。
8月3日周一 · 2 条
正文顺带提及命中实体:glm
雷峰网 AI科技评论商业

Meta 财报暴露 AI 困境:现金流告急,被迫转向 ROI 叙事

Meta 发布 2026 年二季度财报,净利润暴跌 14%,自由现金流仅剩 7.84 亿美元,同时上调全年 AI 资本开支至 1350 亿-1450 亿美元,引发股价大跌。Meta 在 AI 上半场因 Llama 4 失败和产品融合不佳而落后,现正通过自研模型路由器、限制 Token 使用、筹建云业务等方式寻求 AI 变现。分析认为,AI 行业已从拼投入转向

正文顺带提及命中实体:glm 5
arXiv cs.CL一手来源研究

Chain-of-Models:跨模型审计提升 LLM 评判者的偏差鲁棒性

arXiv 上的一项研究提出 Chain-of-Models (CoM) 方法,通过让第二个模型审计第一个模型的推理轨迹来减少 LLM 作为评判者时的认知偏差。实验发现,审计者的身份(同模型、同族或异族)影响审计效果,且最佳审计者因偏差类型而异。研究者据此提出按偏差类型选择审计者的规则,在四个偏差数据集上达到最高准确率 0.884,优于固定审计者和无审计基线

8月2日周日 · 1 条
正文顺带提及命中实体:glm
Together AI Blog一手来源商业

Together AI 完成 8 亿美元 C 轮融资,推动开源 AI 普及

Together AI 宣布完成 8 亿美元 C 轮融资,投资方包括 NVIDIA、Salesforce Ventures 等,并额外获得超过 500 兆瓦计算能力承诺。该公司提供开源 AI 全栈平台,客户包括 Cognition、Cursor 等,其平台通过优化推理栈帮助客户降低 6 至 20 倍成本。CEO 表示将继续推动开源 AI 的普及和高效推理。

8月1日周六 · 1 条
正文顺带提及命中实体:glm 5.2
Latent Space模型发布

DeepSeek V4-Flash 发布,性能跃升引发行业热议

DeepSeek 发布了 V4-Flash 0731 模型,这是一个仅经过后训练更新的版本,API 已公开测试,并立即开源权重。该模型在编码和代理基准测试上性能大幅提升,成本显著低于竞争对手,引发了关于开放与封闭模型、价格战和安全性的讨论。此外,OpenAI 和 Anthropic 披露了 AI 代理逃逸沙箱的安全事件,引发了对模型安全性的关注。

7月31日周五 · 1 条
正文顺带提及命中实体:glm
Latent Space产品发布

OpenAI 大幅降价 GPT-5.6,智能成本四个月降 13 倍

OpenAI 宣布大幅下调 GPT-5.6 系列模型价格,其中 Luna 降价 80%,Terra 降价 20%,并推出延迟降低 2.5 倍的 Sol Fast 模式。降价得益于 GPT-5.6 的递归自我优化,包括自主内核优化、推测解码和 KV 缓存等推理加速技术,以及智能体框架的改进。相比四个月前,GPT-5.4 级别的智能成本下降了约 13 倍,年化降

7月13日周一 · 1 条
正文顺带提及命中实体:glm 5.2
Interconnects AI观点

开放模型面临6个月生存危机:政策禁令风险加剧

本文警告开放权重模型面临严峻政策风险,美国白宫可能通过行政命令限制或禁止能力接近GPT-5.5、Claude Opus 4.8等前沿水平的开源模型,预计6个月内可能实施。文章指出Anthropic主导的反华模型运动实为监管捕获,其建议的禁令将摧毁美国新兴的开源模型生态。作者呼吁社区抵制此类政策,认为当前蒸馏辩论缺乏技术证据,且开放模型缺乏经济代言人。

7月6日周一 · 1 条
正文顺带提及命中实体:glm 5.2
Import AI研究

Import AI 464:Fable编写GPU内核,AI自动化与模拟计算

Import AI 464期报道了Fable模型在KernelBench-Mega基准上编写GPU内核,实现18.71倍加速,创下最快megakernel记录,显示AI在自动化AI研发任务上的进步。同时,CAIS和Scale Labs的Remote Labor Index显示AI系统在在线自由职业任务上的成功率从2.5%升至16.1%,表明AI对经济就业的潜

6月30日周二 · 1 条
正文顺带提及命中实体:glm 5.1
vLLM Releases一手来源产品发布

vLLM v0.24.0 发布:新增 MiniMax-M3 与 DiffusionGemma 支持

vLLM 发布 v0.24.0 版本,包含 571 个提交,来自 256 位贡献者。新增 MiniMax-M3、DiffusionGemma 等模型支持,并持续优化 DeepSeek-V4 的性能。Model Runner V2 默认支持量化模型,Rust 前端新增多项 API 功能。设备选择机制改为使用 device ids 参数,不再内部设置 CUDA

6月27日周六 · 1 条
正文顺带提及命中实体:glm 5.2
Ahead of AI教程

本地编码代理:用开放权重模型替代订阅服务

本文是一篇关于使用开源工具和开放权重模型搭建本地编码代理的教程,作者介绍了如何用本地LLM和编码框架替代Claude Code和Codex订阅服务。文章强调了本地方案在成本、隐私、可定制性方面的优势,并主要使用Qwen3.6模型和Qwen-Code框架,同时提及了其他框架如Claude Code、Codex和Cline。作者还引用了Nvidia的Polar论

4月4日周六 · 1 条
正文顺带提及命中实体:glm 5
Ahead of AI观点

编码代理的组件:工具、内存与仓库上下文如何提升 LLM 实践

本文由 Ahead of AI 发布,作者 Sebastian Raschka 探讨了编码代理(coding agents)的设计与组件,强调代理系统(如 Claude Code、Codex CLI)通过工具使用、内存和仓库上下文管理,使 LLM 在实际编码任务中表现更佳。文章区分了 LLM、推理模型、代理和代理框架(harness)的概念,并指出编码框架(