返回主题地图

Agent 智能体

技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2400 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

8月31日周一 · 8 条
正文结构化主题已通过公开置信门槛
Agno Releases一手来源产品发布

Agno v3.0.3:知识库按页摄入与工具集更新

Agno 发布 v3.0.3,为知识库引入按页网站摄入和按文件文件夹摄入,每页/每文件独立行,支持摘要驱动刷新、失败隔离和级联删除。新增 SitemapReader 和 PageFetcher 以改进 URL 抓取,PDF 条目可引用,并提供 KnowledgeManagementTools 和 AgentOS 知识路由。修复了多页 URL 删除时向量残留、

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering产品发布

Cloudflare 推出 AI Search,简化代理和开发者的自定义数据搜索

Cloudflare 推出了 AI Search 服务,为 AI 代理和开发者提供内置的搜索和检索功能,支持代理集成、多模态搜索,并与其他 Cloudflare 工具无缝集成。该服务自动处理爬取、解析、嵌入、向量数据库和搜索 API 等端到端搜索流程,并支持无 sitemap 的自动发现模式。AI Search 可通过单个命令创建搜索实例,并可通过 Work

正文结构化主题已通过公开置信门槛
Mistral Platform Changelog一手来源模型发布

Mistral 发布 Mistral Small 4 与开源代码智能体 Leanstral

Mistral 发布了 Mistral Small 4,这是一个统一指令、推理和编码的多模态混合模型,支持 256k 上下文窗口。同时,Mistral 还发布了 Leanstral,这是其首个面向 Lean 4 形式化证明工程的开源代码智能体。

正文结构化主题已通过公开置信门槛
Mistral Platform Changelog一手来源模型发布

Mistral 发布多模态模型 Medium 3.5,支持调节推理

Mistral 发布了 Mistral Medium 3.5,这是一个面向智能体和编码用例的前沿多模态模型,支持通过 reasoning effort 参数调节推理强度,并以修改版 MIT 许可证开放权重。

正文结构化主题已通过公开置信门槛
DeepSeek API Changelog一手来源模型发布

DeepSeek 发布 V3.1 混合推理模型,提升 Agent 能力

DeepSeek 将 deepseek-chat 和 deepseek-reasoner 升级为 DeepSeek-V3.1,分别对应非思考模式和思考模式。新模型采用混合推理架构,支持两种模式,思考效率较 R1-0528 提升,并通过后训练优化增强了 Agent 能力,在 SWE-bench 等基准上表现优异。

正文结构化主题已通过公开置信门槛
DeepSeek API Changelog一手来源模型发布

DeepSeek 发布 V3.1-Terminus 升级,改进语言一致性与 Agent 能力

DeepSeek 将 deepseek-chat 和 deepseek-reasoner 升级为 DeepSeek-V3.1-Terminus,分别对应非思考模式和思考模式。此次更新改进了语言一致性,缓解中英文混杂和异常字符,并优化了 Code Agent 与 Search Agent 的表现。

正文结构化主题已通过公开置信门槛
DeepSeek API Changelog一手来源模型发布

DeepSeek-V4-Pro 正式版发布,增强 Agent 能力并调整 API 定价

DeepSeek 发布 V4-Pro 正式版,同步上线 APP、网页端和 API,模型名 deepseek-v4-pro。该版本显著增强 Agent 能力,在多项基准测试中表现优异,并原生支持 OpenAI Responses API 格式,适配 Codex。同时新增思考强度控制(low/high/max),并调整 API 定价,采用峰谷定价策略,闲时价格减

正文结构化主题已通过公开置信门槛
DeepSeek API Changelog一手来源模型发布

DeepSeek 发布多模态视觉模型 V4-Flash-Vision-Exp

DeepSeek 发布了实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,已上线 API 平台,用户可通过设置 model='deepseek-v4-flash-vision-exp' 访问。该模型在纯文本能力上与正式版持平,但在视觉理解的 Agent 基准测试中大幅提升,接近 Opus-4.8。

另有 1 家信源报道

8月30日周日 · 10 条
正文结构化主题已通过公开置信门槛
Xinference Releases一手来源产品发布

Xinference v3.3.0 发布:新增多模型支持与路由功能

Xinference 发布 v3.3.0 版本,新增了对多个模型的支持,包括 Qwen3.8、DeepSeek V4 Flash、GLM-Image、Kimi-K3 等,并引入了 token 感知的虚拟模型路由、Anthropic Messages 协议适配器、世界模型生成等新功能。此外,该版本还增强了音频、图像、视频等多模态能力,并修复了若干 bug。

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布

NC-AI 联盟发布 VAETKI-100B-A10B 多语言 MoE 大模型

NC-AI 联合 13 家机构组成的 NC-AI 联盟发布了 VAETKI-100B-A10B 大型语言模型,采用 MoE 架构,总参数 112.2B,激活参数 10.1B,支持韩、英、中、日四种语言,上下文长度 32k,基于 MIT 许可开源。该模型针对推理、知识应用和智能体场景设计,工具智能体任务使用非思考模式,其他任务使用思考模式,并经过人类偏好对齐。

正文结构化主题已通过公开置信门槛
THE DECODER研究

AI代理缺乏时间感知,影响长任务执行

一项由MATS研究项目支持的新研究发现,Anthropic的Claude Code和OpenAI的Codex等AI编程助手缺乏时间感知能力,无法准确估计任务所需时间或已用时间。在测试中,它们普遍高估任务时长,且对自身工作质量的评估也不可靠。研究者指出,这种缺陷会影响长时间任务的执行和可控性,但提供时间报告工具时,代理几乎总能正确报告时间。

正文结构化主题已通过公开置信门槛
THE DECODER商业

Anthropic调整Claude Code限额:名义上涨实际削减17%

Anthropic 宣布自9月14日起,将 Claude Code 的周使用限额永久提高25%,但同时取消当前50%的临时提升,实际可用容量将减少17%。官方确认了这一变更,并承诺改进用户体验和透明度。此外,Anthropic 近期为 Claude Code 增加了性能优化和自动反馈工具。

另有 1 家信源报道

正文结构化主题已通过公开置信门槛
Vercel AI SDK Releases一手来源产品发布

Vercel AI SDK 发布 ai@6.0.272 版本

Vercel AI SDK 发布了 ai@6.0.272 版本,主要更新包括:拒绝不符合必需或特定工具选择的 generateText 响应,并在 ToolChoiceViolationError 中暴露标准化响应内容以支持选择性恢复;修复了允许在 ToolLoopAgent 设置和 prepareCall 中使用工具审批密钥的问题。同时更新了相关依赖包。

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering开源

AWS 开源 Kiro Crew,支持异步编码代理

AWS 开源了 Kiro Crew,这是一个用于异步编码代理的系统,支持跨会话、工具和任务运行多个 Kiro 编码代理。该系统允许开发人员分配异步编码任务,如事件调查、工单分类、迁移和 PR 监控,无需持续监督。Kiro Crew 提供共享内存、可复用技能、定时任务、并发代理等功能,并支持通过 MCP 和 webhooks 集成外部工具。该系统在亚马逊内部已

正文结构化主题已通过公开置信门槛
Agno Releases一手来源产品发布

Agno v3.0.2 发布:新增集成与 MCP 改进

Agno 发布 v3.0.2 版本,包含多项行为变更、新集成和改进。行为变更包括运行元数据优先级调整、MCPConfig 拒绝未知字段、推理检测改为询问提供商等。新集成支持 Synthorai 模型提供商、WaveSpeed 图像视频生成、Serply 搜索工具包和 AtomicMail 邮件工具包。改进包括将 Agent/Team/Workflow 作为

正文结构化主题已通过公开置信门槛
LiteLLM Releases一手来源产品发布

LiteLLM v1.100.0-rc.1 发布:镜像签名验证与多项修复

LiteLLM 发布 v1.100.0-rc.1 版本,所有 Docker 镜像均使用 cosign 签名,并提供了基于提交哈希和发布标签的验证方法。该版本包含多项修复和功能更新,包括 Anthropic 消息处理、复杂性路由器、提示缓存节省报告、模型注册表更新、代理搜索工具、MCP 工具集强制、以及多个测试和 UI 改进。

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布

Surge 发布 AriannaV4:基于 Gemma 4 的多模态本地助手

Surge 发布了 AriannaV4,一个基于 google/gemma-4-12B 与 Aria v4 权重合并的多模态本地助手模型。该模型采用核心权重加侧车架构,支持文本、推理、视觉、音频和视频理解,并提供 GGUF 量化版本供 llama.cpp、Ollama 和 LM Studio 使用。模型遵循 CC-BY-NC-SA 4.0 许可证。

正文结构化主题已通过公开置信门槛
Hugging Face Blog一手来源开源

three.ws 开源栈:为 AI 代理提供身体、大脑、钱包与工作

three.ws 是一个开源平台,为 AI 代理提供 3D 生成、动画、支付和分发能力。其代码以 Apache-2.0 协议在 GitHub 上开源,模型托管在 Hugging Face。平台通过多引擎路由实现免费优先的 3D 生成,并支持照片到虚拟形象、骨骼动画、x402 支付标准及 MCP 集成。该平台旨在将代理的“身体、大脑、钱包和分发”整合为单一产品

8月29日周六 · 2 条
正文结构化主题已通过公开置信门槛
量子位研究

本地部署AI不如官方版原因找到:推理栈微小差异致输出偏差

Level1Techs论坛用户thr3e通过实验发现,AI模型本地部署性能不如官方版的原因在于推理软件栈的微小差异,如注意力后端、KV缓存量化、权重量化方案等,这些差异会导致浮点运算产生数值偏移,进而改变输出token。实验显示,切换注意力后端或使用INT4 KV缓存会导致工具调用失败,而英伟达NVFP4权重量化表现最差。thr3e正在打包测试工具供其他用户

正文结构化主题已通过公开置信门槛
量子位研究

清华姚班新班主任徐梦迪:从车辆工程到AI,主张机器人需适应能力

清华大学姚班2026级新生班主任徐梦迪,本科毕业于清华车辆工程,后赴CMU获机械工程博士,曾在斯坦福从事博士后研究,2025年9月加入清华交叉信息院。她研究机器人学习与AI安全,主张通用机器人不能仅依赖Scaling Law,还需具备适应能力,其博士论文获CMU最佳论文奖。姚班近年扩展至AI与量子信息方向,四位新班主任研究领域多元,体现交叉培养趋势。