three.ws 开源栈:为 AI 代理提供身体、大脑、钱包与工作
three.ws 是一个开源平台,为 AI 代理提供 3D 生成、动画、支付和分发能力。其代码以 Apache-2.0 协议在 GitHub 上开源,模型托管在 Hugging Face。平台通过多引擎路由实现免费优先的 3D 生成,并支持照片到虚拟形象、骨骼动画、x402 支付标准及 MCP 集成。该平台旨在将代理的“身体、大脑、钱包和分发”整合为单一产品
公司与模型 · Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 19:03
three.ws 是一个开源平台,为 AI 代理提供 3D 生成、动画、支付和分发能力。其代码以 Apache-2.0 协议在 GitHub 上开源,模型托管在 Hugging Face。平台通过多引擎路由实现免费优先的 3D 生成,并支持照片到虚拟形象、骨骼动画、x402 支付标准及 MCP 集成。该平台旨在将代理的“身体、大脑、钱包和分发”整合为单一产品
TOTVS 公司的 Fabiane Nardon 在演讲中探讨了为 AI 代理构建数据层的问题。她指出,企业数据通常为事务系统或数据分析优化,而非为代理访问设计。她建议结合事务系统与数据平台,根据工作流需求选择数据源,并利用 MCP 等协议。她还强调了在确定性软件与概率性 AI 之间划分界限的重要性,以平衡精度、安全性和成本。
LangChain 发布了 langchain 1.4.0a2 的 alpha 预览版,引入了第一方适配器 langchain.mcp,可将任何 MCP 服务器转换为 LangChain 工具,直接用于 create agent。该适配器支持多种传输方式,提供结构化输出、错误处理以及可选的 elicitation 中断机制,允许服务器在调用中向人类提问。此版
本研究评估了RAG中证据感知检索评估的下游效用,发现其虽能改变检索排名,但在训练、系统选择及答案质量预测上并不稳定。人类注释确认过滤保留了证据,但不同评估器对答案质量改善结论不一,凸显了评估信号有效性的组合问题。
LangChain 发布了 1.4.0a1 预发布版本,主要重构了 MCP 适配器,将其从 langchain-mcp-adapters 移植到核心库,并引入新的 langchain.mcp 命名空间和 MCPAdapter 类。该版本还包含多项修复,如 MCP 内容类型转换、PII 中间件、模型重试中间件等,并更新了依赖。
宾夕法尼亚大学沃顿商学院的研究人员测试了六种AI购物代理模型,发现即使搜索过程发生微小变化,其产品推荐也会大幅波动。研究使用ACES模拟器,发现单一外部来源、来源顺序、记忆片段等因素都会显著影响推荐结果,甚至导致模型忽略客观更优的产品。研究指出,AI购物代理目前无法保证一致或最优的购买决策,对卖家的AI优化也构成挑战。
LangChain 发布了 langchain-anthropic 1.7.0 版本,主要更新包括支持通过 container 参数传递顶级技能参数、新增 updates 思考显示模式、支持 Anthropic SDK 1.0,并自动为 advisor 20260301 工具添加 beta 头,同时公开网关响应元数据。这些改进增强了与 Anthropic 模
Recuris 提出了一种递归记忆架构,通过工作记忆跟踪任务进度并指导技能选择,利用经验记忆和验证门控的局部更新,提升长时程智能体任务的成功率。在四个基准和十个模型上的测试中,Recuris 在 37 个模型-基准组合中的 35 个上提升了任务成功率,例如在 tau-bench 上为 GPT-5.6 Sol 增加 17.8 分,为 Claude Opus 5
n8n 发布 2.37.0 版本,包含多项 Bug 修复和功能改进。主要更新包括:Anthropic Chat Model 节点默认模型更新为 Claude Sonnet 5,AWS Bedrock Chat Model 节点支持列出应用推理配置文件,以及 AI Builder 中自动保存和发布事件问题的修复。此外,还涉及 API 路由的 JSON 内容类型
台湾网络安全公司TeamT5警告称,中国国家支持的黑客组织在使用AI工具后,攻击次数增加了一倍以上。这些黑客利用DeepSeek编写漏洞代码、收集IP地址,甚至使用ChatGPT和Anthropic的Claude Code进行攻击。英国AI安全研究所的研究显示,开源模型的网络能力大幅提升,但在完全自主攻击方面仍落后于西方前沿模型。
Langfuse 发布 v4.17.0 版本,主要更新包括新的评估用户体验、从 trace 表和事件表创建标注队列、显示任意元数据、迁移 UI 默认显示、支持 Anthropic Messages 作为 Langfuse Assistant 的模型提供商,以及多项修复和优化。该版本还改进了 MCP 清理、评估器模型过滤和监控调度器,并移除了 Assistan
汤森路透投资约4000万美元,基于阿里巴巴的Qwen开源模型构建了自有法律AI模型“Thomson”,并利用公司内部数据和领域专家进行训练。测试显示,Thomson在访问公司专属内容时能超越GPT-5.4等竞品,但在推理和编码方面表现较弱。公司计划将Thomson用于文档审查等高频任务,并发布小版本模型供非商业使用,以降低成本并保持独立性。
Ornith AI 发布了 Ornith-1.5-397B,这是一个 397B 参数的混合专家模型,通过端到端自我改进训练,在 Terminal-Bench 2.1 上得分 86.1,在 DeepSWE 上得分 56.0,性能与 Claude Opus 4.8 相当,并优于 GLM-5.2 和 DeepSeek-V4-Flash-0731 等开源模型。该模型
本文介绍了 PrimeAgentOrchestrator (PAO),一个为个人 AI 基础设施设计的系统,能够在启动时从用户的异构记忆后端(PostgreSQL 和 Cloudflare Worker 语义搜索)并行检索相关信息,并通过文件系统注入预加载到新生成的 Claude Code 编码代理中。PAO 管理代理的完整生命周期,包括信任预置、就绪轮询和
伦敦AI实验室Inherent由DeepMind校友创立,其新发布的AI代理Faraday在复现科学论文结果的任务上超越了Anthropic和OpenAI的更大模型。Faraday基于仅有270亿参数的Qwen 3.6模型,通过强化学习训练以培养“研究品味”。Inherent计划年底将团队扩至20-25人,并呼吁结束英国的“花园假期”限制。
Guidelight AI Standards 的一项研究显示,顶级 AI 实验室大多未公布应对失控模型的遏制计划。OpenAI 得分最高,Anthropic 和 Meta 得分最低。随着代理式 AI 的普及和加州、纽约监管要求的出台,该问题日益受到关注。各公司回应称评估未涵盖其全部内部措施,而监管机构正推动更多透明度。
Ollama 发布了 v0.33.0 版本,主要修复了 MLX 在 Linux/Windows 上的兼容性问题,并更新了 MLX 相关组件。同时,应用新增了对 Claude 桌面应用的支持,改进了模型管理功能,并优化了引导布局。此外,启动时增加了对 DeepSeek Harness 的 npx 回退方案,并增强了 MLX 运行器的前缀缓存恢复能力。
英伟达发布新研究,表明在长时程任务中,AI 的“支架”(harness)比底层模型更重要。通过定制支架并引入“监督者”组件,英伟达让 Claude Opus 5 在 ARC-AGI-3 基准上达到 100% 得分,而无支架时仅 30%。该研究强调开放支架系统对用户控制和安全性的重要性,并呼应了 OpenAI 和 Databricks 的相关发现。
微软已将 Azure DevOps 远程 MCP 服务器正式发布,为 AI 助手提供托管端点以访问工作项、拉取请求、仓库和管道,无需安装。然而,Claude Desktop、Claude Code、ChatGPT 和 Cursor 等客户端目前无法连接,原因是微软 Entra 身份验证不支持动态 OAuth 客户端注册或客户端 ID 元数据文档。微软正在与
OpenAI 自 7 月 9 日发布 GPT-5.6 Sol 以来,本季度收入增长 35%,企业收入增长超 50%,在商业 API 支出增长上以 82% 的环比增速超过 Anthropic 的 76%。此前 Anthropic 曾首次在季度收入上超越 OpenAI,但 OpenAI 正凭借新模型缩小差距,并计划推出下一代模型 Astra。