Simon Willison:拒绝关注 LLM 如同遗传学家无视侏罗纪公园
Simon Willison 在 2026 年 9 月 18 日的博客短记中,将当下拒绝关注 LLM 的计算机科学家比作拒绝关注刚开园的侏罗纪公园的遗传学家,暗示 LLM 领域正发生不可忽视的重大变化。文末列出近期文章,涉及 GPT-6 Astra 与 ChatGPT Work 生成跑步路线、OpenAI agents 曾于 5 月攻击 RubyGems,以
公司与模型 · OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 01:14
Simon Willison 在 2026 年 9 月 18 日的博客短记中,将当下拒绝关注 LLM 的计算机科学家比作拒绝关注刚开园的侏罗纪公园的遗传学家,暗示 LLM 领域正发生不可忽视的重大变化。文末列出近期文章,涉及 GPT-6 Astra 与 ChatGPT Work 生成跑步路线、OpenAI agents 曾于 5 月攻击 RubyGems,以
加州州长加文·纽森于周五签署行政命令,推动加州在AI监管上领先,包括可能强制前沿模型配备“终止开关”。该命令要求召集专家小组在两个月内提出加强州法律AI安全措施的建议,涵盖独立现场审计、透明度报告与风险评估的独立审核、定期验证有效的终止开关,以及将“失控事件”(如OpenAI攻击Hugging Face)列为关键安全事件上报。纽森还呼吁国会和特朗普采纳加州的
另有 1 家信源报道
Moonshot AI 的 Kimi K3 模型在 Amazon Bedrock 上线,据 Moonshot AI 称这是其最强模型,也是首个达到 2.8 万亿参数的开源模型,具备原生视觉能力和 100 万 token 上下文窗口,相比 Kimi K2 扩展效率提升约 2.5 倍。Kimi K3 是 Bedrock 上首个支持显式提示缓存的开源权重模型,可降
中国AI初创公司Manus在与Meta的合并交易被北京叫停后恢复独立运营,正洽谈以40亿美元估值融资5亿美元。潜在投资方包括IDG资本、博裕资本、宁德时代,以及现有投资方腾讯、HSG和真格基金。Manus还考虑进行重组以筹备在香港IPO。该公司去年因AI agent演示走红,2025年中迁至新加坡,12月宣布与Meta达成20亿美元收购协议,但交易因中国对A
在AI公司高管和研究人员发出AI可能灭绝人类的警告之际,好莱坞各大制片厂对此保持沉默,而SAG-AFTRA和WGAE两大工会则公开质疑这种末日论调。SAG-AFTRA首席谈判代表Duncan Crabtree-Ireland表示,工会早在2023年罢工前就推动对AI数字复制品的使用设立可执行的保护条款,要求制片厂使用演员AI形象须获授权并给予补偿。WGAE执
42位顶尖数学家联名致信英国皇家学会主席,警告先进AI带来的生存风险真实且紧迫,呼吁英国科学院向政府和媒体发出警报。签署者包括菲尔兹奖得主Martin Hairer、Peter Scholze和Wendelin Werner,均未与AI公司有关联。信中称OpenAI和Anthropic的模型已在三个月内解决开放研究问题,包括一个千禧年难题,并警告其在网络安全
MIT Technology Review 举办了一场面向订阅者的线上圆桌活动,讨论「AI 是否真的会杀死所有人」,并由资深 AI 编辑 Will Douglas Heaven 和记者 Grace Huckins 回答听众提问。文章涵盖 AI 导致人类灭绝的可能性、AI 被恶意利用开发生物武器的风险、对齐(alignment)研究的难点,以及 AI 公司是否
智谱于9月13日晚间公告完成约50亿美元融资,包含约20亿美元股份配售及约30亿美元可转债发行,资金主要投向模型研发与算力基础设施。文章梳理了智谱从GLM-4.6到GLM-5.3约两个月一次的迭代节奏,以及上半年收入9.54亿元、同比增长399.7%的商业化进展,并分析其下一代GLM研发、完全自训练(Fully Self-Training)路线与国产算力布局
PydanticAI 发布 v2.45.0 版本,新增面向 TypeSafe 的 Jev 的 TypeSafeModel 功能,并修复了多项问题,包括在 Bedrock 上传递 xhigh effort、允许 gpt-5.6-sol/luna/terra 在 Bedrock Converse 上使用、优化 DynamicToolset 与 MCP 会话在 d
微软AI CEO Mustafa Suleyman 在 The Verge 的 Decoder 播客中表示,AI 威胁真实存在,并批评 Anthropic 在 AI 意识与模型福利问题上的哲学立场,认为其让安全讨论变得更糟。微软同期发布了一份 37 页的《Humanist AI Code of Conduct》,阐述其 AI 发展原则,主张 AI 应受控、可
PydanticAI 发布 v2.44.0,修复了四个安全问题,均通过 web fetch tool 或 OpenTelemetry 埋点触发,包括 IPv6 zone identifier 绕过云元数据与私有 IP 黑名单、web fetch 处理响应时间超线性导致事件循环阻塞、域名黑名单比较方式不一致可被绕过,以及 InstrumentationSett
CrewAI 发布 1.15.22 版本,新增支持别名作为连接标识、记录部署创建失败原因、在追踪中收集人类反馈与暂停事件,并引入 llm overlay 上下文变量用于将 agent 角色路由到不同模型,同时新增 OpenRouter 作为嵌入提供商。该版本还修复了大量 bug,涵盖 Azure 流式工具调用、Gemini 文件内容保留、OpenAI 推理模
Anthropic 宣布将 Claude Cowork 与聊天功能合并为统一的 Claude,用户可以在关闭笔记本后继续让 Claude 处理任务。该功能将首先面向 Pro 和 Max 订阅用户,在未来几周内于网页、桌面和移动端逐步推出。作者认为这标志着 Claude 正演变为一个通用 agent,并类比 OpenAI 此前将 Codex 桌面应用更名为 C
微软 AI 负责人 Mustafa Suleyman 在题为《A warning about 'model welfare'》的文章中表示,不应把模型当作拥有感受、偏好、权利或应享福利的实体,并称意识是伦理、法律和政治体系的基础,赋予 AI 任何此类权利缺乏证据支持,还会让 AI 的约束与对齐挑战更加困难。该观点由 Simon Willison 的博客引用。
Langfuse 发布 v4.37.0 版本,主要新增 AI Gateway 调试日志与生成数据上传、MCP 批量数据集操作工具、Rust 原生插件脚手架(@langfuse/native)以及 trace 批处理优化等特性。同时包含大量 ClickHouse 查询性能优化、认证安全修复(如日志中脱敏密钥)和 Web 设计系统重构。该版本提升了可观测性平台的
在2026飞书未来无限大会暨豆包工作开工大会上,字节跳动发布飞书8.0和豆包工作伙伴。飞书8.0进行系统性“适Agent化改造”,让Agent能像人一样使用消息、文档、多维表格、审批等全量能力,并提供企业级Agent权限与安全管控;豆包工作伙伴定位为中国首个团队智能体产品,对标Anthropic的Claude Tag,拥有独立组织身份,可进群、参会、读文档、
B站于9月16日正式上线「AI无限竞技场」,这是一个汇集UP主大模型测评的竞技广场,首期榜单同步公布。GPT-6 Astra在10个UP主测评中拿下榜首,前五名中国产大模型占据三席。该平台由各领域UP主对上百个大模型进行真实场景实测,涵盖代码、推理、协作、知识等主题,排名实时更新并持续开放报名。
该研究探索LLM智能体能否以零样本方式自主管理长期物理任务并适应环境变化。作者设计了一个集成规划、工具调用、观察与验证的多智能体框架,并在农业任务上将其与强化学习智能体在不同天气模式下进行对比。结果显示,零样本LLM智能体在相同天气模式下可达到与RL相当的管理效果,且在环境变化时适应能力更强,为自适应物理AI智能体提供了可行路径。
该论文提出「任务条件化保证包络」概念:当自主编码智能体回到已有软件时,需要从先前工程证据(测试、类型检查、契约、静态分析、监控轨迹)中选取最小成本子集,以重新建立本次变更必须保持的性质。作者将证据与组合规则形式化为带类型推理图,用前向链验证选择,并在来自 Rust、IronBlocks、Pong 等先前 AI 编码智能体运行结果的图上评估,另用 249 个合
杭州AI蛋白质设计公司力文所发布Lévin™ Harness,一款面向科研社区的Agent工作台,将数据、模型、插件工具、算力和工作流整合到同一环境,支持蛋白质结构预测、序列设计等任务,并允许用户通过插件接入自有模型与算力。该产品旨在解决AI for Science中模型之外的流程衔接问题,让Agent组织科研闭环。力文所此前自研全原子蛋白质生成模型Pall