返回主题地图

Anthropic / Claude

公司与模型 · Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 19:03

相关与对比厂商作为比较对象、合作方或受影响主体,当前共 230 条。
8月30日周日 · 1 条
对比或关联对象命中实体:mcp
Hugging Face Blog一手来源开源

three.ws 开源栈:为 AI 代理提供身体、大脑、钱包与工作

three.ws 是一个开源平台,为 AI 代理提供 3D 生成、动画、支付和分发能力。其代码以 Apache-2.0 协议在 GitHub 上开源,模型托管在 Hugging Face。平台通过多引擎路由实现免费优先的 3D 生成,并支持照片到虚拟形象、骨骼动画、x402 支付标准及 MCP 集成。该平台旨在将代理的“身体、大脑、钱包和分发”整合为单一产品

8月29日周六 · 2 条
标题相关提及命中实体:mcp
InfoQ AI ML and Data Engineering观点

为AI代理构建数据层:从事务系统到MCP与语义模型

TOTVS 公司的 Fabiane Nardon 在演讲中探讨了为 AI 代理构建数据层的问题。她指出,企业数据通常为事务系统或数据分析优化,而非为代理访问设计。她建议结合事务系统与数据平台,根据工作流需求选择数据源,并利用 MCP 等协议。她还强调了在确定性软件与概率性 AI 之间划分界限的重要性,以平衡精度、安全性和成本。

对比或关联对象命中实体:mcp
LangChain Releases一手来源产品发布

LangChain 发布 1.4.0a2,推出 MCP 适配器集成

LangChain 发布了 langchain 1.4.0a2 的 alpha 预览版,引入了第一方适配器 langchain.mcp,可将任何 MCP 服务器转换为 LangChain 工具,直接用于 create agent。该适配器支持多种传输方式,提供结构化输出、错误处理以及可选的 elicitation 中断机制,允许服务器在调用中向人类提问。此版

8月28日周五 · 3 条
对比或关联对象命中实体:claude
arXiv cs.IR一手来源研究

证据感知检索在RAG中的下游效用评估

本研究评估了RAG中证据感知检索评估的下游效用,发现其虽能改变检索排名,但在训练、系统选择及答案质量预测上并不稳定。人类注释确认过滤保留了证据,但不同评估器对答案质量改善结论不一,凸显了评估信号有效性的组合问题。

对比或关联对象命中实体:mcp
LangChain Releases一手来源产品发布

LangChain 1.4.0a1 发布:重构 MCP 适配器并引入新命名空间

LangChain 发布了 1.4.0a1 预发布版本,主要重构了 MCP 适配器,将其从 langchain-mcp-adapters 移植到核心库,并引入新的 langchain.mcp 命名空间和 MCPAdapter 类。该版本还包含多项修复,如 MCP 内容类型转换、PII 中间件、模型重试中间件等,并更新了依赖。

对比或关联对象命中实体:claude opus 4.8
THE DECODER研究

研究:AI购物代理推荐不稳定,易受微小上下文影响

宾夕法尼亚大学沃顿商学院的研究人员测试了六种AI购物代理模型,发现即使搜索过程发生微小变化,其产品推荐也会大幅波动。研究使用ACES模拟器,发现单一外部来源、来源顺序、记忆片段等因素都会显著影响推荐结果,甚至导致模型忽略客观更优的产品。研究指出,AI购物代理目前无法保证一致或最优的购买决策,对卖家的AI优化也构成挑战。

8月27日周四 · 1 条
对比或关联对象命中实体:anthropic
LangChain Releases一手来源产品发布

langchain-anthropic 1.7.0 发布:支持 SDK 1.0 与技能参数

LangChain 发布了 langchain-anthropic 1.7.0 版本,主要更新包括支持通过 container 参数传递顶级技能参数、新增 updates 思考显示模式、支持 Anthropic SDK 1.0,并自动为 advisor 20260301 工具添加 beta 头,同时公开网关响应元数据。这些改进增强了与 Anthropic 模

8月26日周三 · 1 条
对比或关联对象命中实体:claude opus 5
Hugging Face Daily Papers一手来源研究

Recuris:递归经验-工作记忆演化提升长时程智能体性能

Recuris 提出了一种递归记忆架构,通过工作记忆跟踪任务进度并指导技能选择,利用经验记忆和验证门控的局部更新,提升长时程智能体任务的成功率。在四个基准和十个模型上的测试中,Recuris 在 37 个模型-基准组合中的 35 个上提升了任务成功率,例如在 tau-bench 上为 GPT-5.6 Sol 增加 17.8 分,为 Claude Opus 5

8月25日周二 · 2 条
对比或关联对象命中实体:anthropic
n8n Releases一手来源产品发布

n8n 2.37.0 发布:更新 Claude 默认模型并修复多项 AI 功能

n8n 发布 2.37.0 版本,包含多项 Bug 修复和功能改进。主要更新包括:Anthropic Chat Model 节点默认模型更新为 Claude Sonnet 5,AWS Bedrock Chat Model 节点支持列出应用推理配置文件,以及 AI Builder 中自动保存和发布事件问题的修复。此外,还涉及 API 路由的 JSON 内容类型

对比或关联对象命中实体:anthropic
THE DECODER安全

台湾安全公司警告:AI工具使中国网络攻击翻倍

台湾网络安全公司TeamT5警告称,中国国家支持的黑客组织在使用AI工具后,攻击次数增加了一倍以上。这些黑客利用DeepSeek编写漏洞代码、收集IP地址,甚至使用ChatGPT和Anthropic的Claude Code进行攻击。英国AI安全研究所的研究显示,开源模型的网络能力大幅提升,但在完全自主攻击方面仍落后于西方前沿模型。

8月24日周一 · 4 条
标题相关提及命中实体:anthropic
Langfuse Releases一手来源产品发布

Langfuse v4.17.0 发布:新评估体验与 Anthropic 支持

Langfuse 发布 v4.17.0 版本,主要更新包括新的评估用户体验、从 trace 表和事件表创建标注队列、显示任意元数据、迁移 UI 默认显示、支持 Anthropic Messages 作为 Langfuse Assistant 的模型提供商,以及多项修复和优化。该版本还改进了 MCP 清理、评估器模型过滤和监控调度器,并移除了 Assistan

标题相关提及命中实体:anthropic
THE DECODER商业

汤森路透斥资4000万美元自建法律AI模型,基于阿里Qwen

汤森路透投资约4000万美元,基于阿里巴巴的Qwen开源模型构建了自有法律AI模型“Thomson”,并利用公司内部数据和领域专家进行训练。测试显示,Thomson在访问公司专属内容时能超越GPT-5.4等竞品,但在推理和编码方面表现较弱。公司计划将Thomson用于文档审查等高频任务,并发布小版本模型供非商业使用,以降低成本并保持独立性。

对比或关联对象命中实体:claude opus 4.8
Hugging Face New and Trending Models一手来源模型发布

Ornith AI 发布 397B 自改进模型 Ornith-1.5,性能对标 Claude Opus 4.8

Ornith AI 发布了 Ornith-1.5-397B,这是一个 397B 参数的混合专家模型,通过端到端自我改进训练,在 Terminal-Bench 2.1 上得分 86.1,在 DeepSWE 上得分 56.0,性能与 Claude Opus 4.8 相当,并优于 GLM-5.2 和 DeepSeek-V4-Flash-0731 等开源模型。该模型

对比或关联对象命中实体:claude code
arXiv cs.AI一手来源研究

PrimeAgentOrchestrator:记忆预置的代理生成系统用于个人AI基础设施

本文介绍了 PrimeAgentOrchestrator (PAO),一个为个人 AI 基础设施设计的系统,能够在启动时从用户的异构记忆后端(PostgreSQL 和 Cloudflare Worker 语义搜索)并行检索相关信息,并通过文件系统注入预加载到新生成的 Claude Code 编码代理中。PAO 管理代理的完整生命周期,包括信任预置、就绪轮询和

8月23日周日 · 2 条
对比或关联对象命中实体:anthropic
TechCrunch AI研究

DeepMind校友创立的Inherent称其AI代理在复现研究上超越Anthropic和OpenAI

伦敦AI实验室Inherent由DeepMind校友创立,其新发布的AI代理Faraday在复现科学论文结果的任务上超越了Anthropic和OpenAI的更大模型。Faraday基于仅有270亿参数的Qwen 3.6模型,通过强化学习训练以培养“研究品味”。Inherent计划年底将团队扩至20-25人,并呼吁结束英国的“花园假期”限制。

对比或关联对象命中实体:anthropic
TechCrunch AI研究

前沿AI实验室缺乏遏制失控模型计划

Guidelight AI Standards 的一项研究显示,顶级 AI 实验室大多未公布应对失控模型的遏制计划。OpenAI 得分最高,Anthropic 和 Meta 得分最低。随着代理式 AI 的普及和加州、纽约监管要求的出台,该问题日益受到关注。各公司回应称评估未涵盖其全部内部措施,而监管机构正推动更多透明度。

8月22日周六 · 2 条
对比或关联对象命中实体:claude
Ollama Releases一手来源产品发布

Ollama v0.33.0 发布:修复 MLX 兼容性并新增 Claude 桌面应用支持

Ollama 发布了 v0.33.0 版本,主要修复了 MLX 在 Linux/Windows 上的兼容性问题,并更新了 MLX 相关组件。同时,应用新增了对 Claude 桌面应用的支持,改进了模型管理功能,并优化了引导布局。此外,启动时增加了对 DeepSeek Harness 的 npx 回退方案,并增强了 MLX 运行器的前缀缓存恢复能力。

对比或关联对象命中实体:claude opus 5
TechCrunch AI研究

英伟达研究:AI 支架比模型本身更关键

英伟达发布新研究,表明在长时程任务中,AI 的“支架”(harness)比底层模型更重要。通过定制支架并引入“监督者”组件,英伟达让 Claude Opus 5 在 ARC-AGI-3 基准上达到 100% 得分,而无支架时仅 30%。该研究强调开放支架系统对用户控制和安全性的重要性,并呼应了 OpenAI 和 Databricks 的相关发现。

8月21日周五 · 2 条
对比或关联对象命中实体:mcp
InfoQ AI ML and Data Engineering产品发布

Azure DevOps 远程 MCP 服务器正式发布,但暂不支持 Claude、ChatGPT 或 Cursor

微软已将 Azure DevOps 远程 MCP 服务器正式发布,为 AI 助手提供托管端点以访问工作项、拉取请求、仓库和管道,无需安装。然而,Claude Desktop、Claude Code、ChatGPT 和 Cursor 等客户端目前无法连接,原因是微软 Entra 身份验证不支持动态 OAuth 客户端注册或客户端 ID 元数据文档。微软正在与

对比或关联对象命中实体:anthropic
THE DECODER商业

GPT-5.6 Sol 推动 OpenAI 收入激增,缩小与 Anthropic 差距

OpenAI 自 7 月 9 日发布 GPT-5.6 Sol 以来,本季度收入增长 35%,企业收入增长超 50%,在商业 API 支出增长上以 82% 的环比增速超过 Anthropic 的 76%。此前 Anthropic 曾首次在季度收入上超越 OpenAI,但 OpenAI 正凭借新模型缩小差距,并计划推出下一代模型 Astra。