微软发布 AutoGen Python v0.7.3 更新
微软发布了 AutoGen Python 库的 v0.7.3 版本。该版本修复了多个问题,包括 RedisStore 对复杂对象的序列化、OpenAIAgent 函数工具模式,并扩展了 pydantic 模型对 anyOf/oneOf 类型的支持。此外,还添加了 gpt-5 的模型信息,并确保任务运行器工具始终严格。
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2525 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
微软发布了 AutoGen Python 库的 v0.7.3 版本。该版本修复了多个问题,包括 RedisStore 对复杂对象的序列化、OpenAIAgent 函数工具模式,并扩展了 pydantic 模型对 anyOf/oneOf 类型的支持。此外,还添加了 gpt-5 的模型信息,并确保任务运行器工具始终严格。
Hugging Face 发布了 smolagents v1.21.1 版本,主要修复了 GPT-5 不支持 stop 参数导致的错误。该修复由开发者 Xmader 提交,解决了使用 GPT-5 时的兼容性问题。
微软发布了 AutoGen Python 库的 v0.7.2 版本,主要更新包括将 DockerCommandLineCodeExecutor 设为 MagenticOne 团队的默认执行器,为 CodeExecutorAgent 添加 approval func 选项,支持 OpenAI 模型客户端的 parallel tool call 配置,以及修复结
Agent2Agent(A2A)协议发布 v0.3.0 版本,引入了多项破坏性变更,包括在安全方案中增加 mTLS 支持、为 OAuth2 元数据添加 URL 字段、允许技能指定安全要求,并将 Agent Card 的托管 URI 从 agent.json 改为 agent-card.json。新版本还增加了获取扩展卡片的方法,并在 AgentCard 中添
Mistral AI 发布了 Codestral 25.08 模型,并推出了面向企业的完整编码栈,包括 Codestral Embed 和 Devstral 代理。该方案旨在解决企业采用 AI 编码工具的部署、定制、集成和可观测性等限制,声称可将开发、审查和测试时间减少 50%。Codestral 25.08 在补全接受率、代码保留和减少失控生成方面有显著提
Agent2Agent(A2A)协议发布了v0.2.6版本,主要修复了类型错误和文档说明,并更新了gRPC对象的JSON名称以支持正确的转码。该版本于2025年7月17日发布,旨在提升协议的稳定性和兼容性。
Mistral AI 为其 AI 助手 Le Chat 推出多项新功能,包括 Deep Research 预览模式、基于 Voxtral 模型的语音模式、由 Magistral 推理模型驱动的多语言推理、Projects 上下文文件夹,以及与 Black Forest Labs 合作的图像编辑功能。这些功能旨在提升用户的深度研究、自然交互和上下文管理体验,用
Mistral AI 与 All Hands AI 合作推出 Devstral Medium 和升级版 Devstral Small 1.1,前者在 SWE-Bench Verified 上得分 61.6%,后者得分 53.6% 且为开源模型中的新 SOTA。Devstral Small 1.1 以 Apache 2.0 协议发布,Devstral Medi
微软发布了 AutoGen Python 库 v0.6.4 版本。该版本改进了 GraphFlow,使其在终止条件触发后能保留执行状态并支持多任务执行,同时移除了内部 StopAgent,将停止信息放入 TaskResult 的 stop reason 字段。此外,McpWorkbench 和 StaticWorkbench 现在支持覆盖工具名称和描述,并修
腾讯开源了 Hunyuan-A13B 大语言模型,采用细粒度 MoE 架构,总参数 800 亿,激活参数 130 亿,支持 256K 上下文和混合推理模式。该模型在数学、科学和智能体等基准测试中表现优异,并提供了技术报告和训练推理手册。
微软发布了 AutoGen Python 库 v0.6.2 版本,引入了流式工具支持,更新了 AgentTool 和 TeamTool 以支持 run json stream,并新增了 tool choice 参数、AssistantAgent 内部工具调用循环、OpenTelemetry GenAI 追踪、Mem0 内存扩展等多项功能。这些更新增强了 Au
Agent2Agent(A2A)协议发布 v0.2.5 版本,包含两个破坏性变更:在 agent card 中新增必填的协议版本字段,以及支持每个任务配置多个 pushNotification。该版本还更新了文档,说明了不可重启任务的相关规范。
Agent2Agent(A2A)协议发布了v0.2.3版本,主要修复了gRPC注释中的一些拼写错误。该版本于2025年6月12日发布,更新内容涉及代码库的细节修正,不影响协议核心功能。
Google 的 A2A 协议发布了 v0.2.2 版本,该版本解决了与 JSON-RPC 2.0 的规范不一致问题,并新增了 gRPC 和 REST 定义、扩展支持以及 AgentCard 的可选 iconUrl 字段。这些更新增强了协议的互操作性和可扩展性,对 AI 代理通信领域有重要影响。
微软发布了 AutoGen Python 库的 v0.6.1 版本,主要修复了 GraphFlow 循环检测和图验证逻辑的 bug,并在 ToolCallSummaryMessage 中增加了函数调用及结果的列表。该版本更新旨在提升框架的稳定性和可调试性。
智谱AI于2025年4月14日升级其AI搜索工具全家桶,覆盖Web Search API、Chat Search和Search Agent三大服务。新增支持bing、搜狗、夸克、Jina.ai等主流搜索引擎,并优化了意图识别和结果搜索准确度。此次升级旨在提升搜索体验,并提供限时特惠。
Chip Huyen 在博客中总结了构建生成式 AI 应用时的常见陷阱,包括过度使用生成式 AI、混淆产品问题与 AI 问题、过早引入复杂技术以及过度依赖早期成功。她通过实例说明,许多团队因产品设计不佳而非 AI 本身导致失败,并强调简单方案往往更有效。文章旨在帮助开发者避免这些常见错误,提升应用成功率。
Chip Huyen 在其博客文章中概述了智能代理的概念,将其定义为通过传感器感知环境并通过执行器采取行动的系统。文章强调基础模型的新能力使得构建自主代理成为可能,并讨论了工具和规划对代理能力的关键作用,以及代理的失败模式和评估方法。文章还指出,该领域缺乏成熟的理论框架,并参考了 Anthropic 的相关博客。
Groq 博客发布了一篇关于 AI 推理(inference)的科普文章,解释了推理在机器学习中的定义、工作原理、类型及实际应用。文章强调推理是模型部署后对新数据做出预测或生成文本的关键步骤,并指出 Groq 的 LPU 推理技术能以高速度和低成本支持实时应用,如语音识别和智能体工作流。文章还提及 Meta 的 Llama 3.3 70B 模型在质量上接近
谷歌发布了 Gemini 2.0 Flash 实验版,该模型速度是 Gemini 1.5 Pro 的两倍,支持双向流式传输、多模态响应生成(文本、图像和语音)以及内置工具使用(如代码执行、搜索和函数调用)。此次发布标志着 Gemini 系列在性能和功能上的重大升级。