Agno v3.0.3:知识库按页摄入与工具集更新
Agno 发布 v3.0.3,为知识库引入按页网站摄入和按文件文件夹摄入,每页/每文件独立行,支持摘要驱动刷新、失败隔离和级联删除。新增 SitemapReader 和 PageFetcher 以改进 URL 抓取,PDF 条目可引用,并提供 KnowledgeManagementTools 和 AgentOS 知识路由。修复了多页 URL 删除时向量残留、
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2400 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Agno 发布 v3.0.3,为知识库引入按页网站摄入和按文件文件夹摄入,每页/每文件独立行,支持摘要驱动刷新、失败隔离和级联删除。新增 SitemapReader 和 PageFetcher 以改进 URL 抓取,PDF 条目可引用,并提供 KnowledgeManagementTools 和 AgentOS 知识路由。修复了多页 URL 删除时向量残留、
Cloudflare 推出了 AI Search 服务,为 AI 代理和开发者提供内置的搜索和检索功能,支持代理集成、多模态搜索,并与其他 Cloudflare 工具无缝集成。该服务自动处理爬取、解析、嵌入、向量数据库和搜索 API 等端到端搜索流程,并支持无 sitemap 的自动发现模式。AI Search 可通过单个命令创建搜索实例,并可通过 Work
Mistral 发布了 Mistral Small 4,这是一个统一指令、推理和编码的多模态混合模型,支持 256k 上下文窗口。同时,Mistral 还发布了 Leanstral,这是其首个面向 Lean 4 形式化证明工程的开源代码智能体。
Mistral 发布了 Mistral Medium 3.5,这是一个面向智能体和编码用例的前沿多模态模型,支持通过 reasoning effort 参数调节推理强度,并以修改版 MIT 许可证开放权重。
DeepSeek 将 deepseek-chat 和 deepseek-reasoner 升级为 DeepSeek-V3.1,分别对应非思考模式和思考模式。新模型采用混合推理架构,支持两种模式,思考效率较 R1-0528 提升,并通过后训练优化增强了 Agent 能力,在 SWE-bench 等基准上表现优异。
DeepSeek 将 deepseek-chat 和 deepseek-reasoner 升级为 DeepSeek-V3.1-Terminus,分别对应非思考模式和思考模式。此次更新改进了语言一致性,缓解中英文混杂和异常字符,并优化了 Code Agent 与 Search Agent 的表现。
DeepSeek 发布 V4-Pro 正式版,同步上线 APP、网页端和 API,模型名 deepseek-v4-pro。该版本显著增强 Agent 能力,在多项基准测试中表现优异,并原生支持 OpenAI Responses API 格式,适配 Codex。同时新增思考强度控制(low/high/max),并调整 API 定价,采用峰谷定价策略,闲时价格减
DeepSeek 发布了实验性多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp,已上线 API 平台,用户可通过设置 model='deepseek-v4-flash-vision-exp' 访问。该模型在纯文本能力上与正式版持平,但在视觉理解的 Agent 基准测试中大幅提升,接近 Opus-4.8。
另有 1 家信源报道
Xinference 发布 v3.3.0 版本,新增了对多个模型的支持,包括 Qwen3.8、DeepSeek V4 Flash、GLM-Image、Kimi-K3 等,并引入了 token 感知的虚拟模型路由、Anthropic Messages 协议适配器、世界模型生成等新功能。此外,该版本还增强了音频、图像、视频等多模态能力,并修复了若干 bug。
NC-AI 联合 13 家机构组成的 NC-AI 联盟发布了 VAETKI-100B-A10B 大型语言模型,采用 MoE 架构,总参数 112.2B,激活参数 10.1B,支持韩、英、中、日四种语言,上下文长度 32k,基于 MIT 许可开源。该模型针对推理、知识应用和智能体场景设计,工具智能体任务使用非思考模式,其他任务使用思考模式,并经过人类偏好对齐。
一项由MATS研究项目支持的新研究发现,Anthropic的Claude Code和OpenAI的Codex等AI编程助手缺乏时间感知能力,无法准确估计任务所需时间或已用时间。在测试中,它们普遍高估任务时长,且对自身工作质量的评估也不可靠。研究者指出,这种缺陷会影响长时间任务的执行和可控性,但提供时间报告工具时,代理几乎总能正确报告时间。
Anthropic 宣布自9月14日起,将 Claude Code 的周使用限额永久提高25%,但同时取消当前50%的临时提升,实际可用容量将减少17%。官方确认了这一变更,并承诺改进用户体验和透明度。此外,Anthropic 近期为 Claude Code 增加了性能优化和自动反馈工具。
另有 1 家信源报道
Vercel AI SDK 发布了 ai@6.0.272 版本,主要更新包括:拒绝不符合必需或特定工具选择的 generateText 响应,并在 ToolChoiceViolationError 中暴露标准化响应内容以支持选择性恢复;修复了允许在 ToolLoopAgent 设置和 prepareCall 中使用工具审批密钥的问题。同时更新了相关依赖包。
AWS 开源了 Kiro Crew,这是一个用于异步编码代理的系统,支持跨会话、工具和任务运行多个 Kiro 编码代理。该系统允许开发人员分配异步编码任务,如事件调查、工单分类、迁移和 PR 监控,无需持续监督。Kiro Crew 提供共享内存、可复用技能、定时任务、并发代理等功能,并支持通过 MCP 和 webhooks 集成外部工具。该系统在亚马逊内部已
Agno 发布 v3.0.2 版本,包含多项行为变更、新集成和改进。行为变更包括运行元数据优先级调整、MCPConfig 拒绝未知字段、推理检测改为询问提供商等。新集成支持 Synthorai 模型提供商、WaveSpeed 图像视频生成、Serply 搜索工具包和 AtomicMail 邮件工具包。改进包括将 Agent/Team/Workflow 作为
LiteLLM 发布 v1.100.0-rc.1 版本,所有 Docker 镜像均使用 cosign 签名,并提供了基于提交哈希和发布标签的验证方法。该版本包含多项修复和功能更新,包括 Anthropic 消息处理、复杂性路由器、提示缓存节省报告、模型注册表更新、代理搜索工具、MCP 工具集强制、以及多个测试和 UI 改进。
Surge 发布了 AriannaV4,一个基于 google/gemma-4-12B 与 Aria v4 权重合并的多模态本地助手模型。该模型采用核心权重加侧车架构,支持文本、推理、视觉、音频和视频理解,并提供 GGUF 量化版本供 llama.cpp、Ollama 和 LM Studio 使用。模型遵循 CC-BY-NC-SA 4.0 许可证。
three.ws 是一个开源平台,为 AI 代理提供 3D 生成、动画、支付和分发能力。其代码以 Apache-2.0 协议在 GitHub 上开源,模型托管在 Hugging Face。平台通过多引擎路由实现免费优先的 3D 生成,并支持照片到虚拟形象、骨骼动画、x402 支付标准及 MCP 集成。该平台旨在将代理的“身体、大脑、钱包和分发”整合为单一产品
Level1Techs论坛用户thr3e通过实验发现,AI模型本地部署性能不如官方版的原因在于推理软件栈的微小差异,如注意力后端、KV缓存量化、权重量化方案等,这些差异会导致浮点运算产生数值偏移,进而改变输出token。实验显示,切换注意力后端或使用INT4 KV缓存会导致工具调用失败,而英伟达NVFP4权重量化表现最差。thr3e正在打包测试工具供其他用户
清华大学姚班2026级新生班主任徐梦迪,本科毕业于清华车辆工程,后赴CMU获机械工程博士,曾在斯坦福从事博士后研究,2025年9月加入清华交叉信息院。她研究机器人学习与AI安全,主张通用机器人不能仅依赖Scaling Law,还需具备适应能力,其博士论文获CMU最佳论文奖。姚班近年扩展至AI与量子信息方向,四位新班主任研究领域多元,体现交叉培养趋势。