Gemini 3.1 Flash Live 发布:更自然可靠的音频AI
Google DeepMind 发布了 Gemini 3.1 Flash Live,这是其最高质量的音频和语音模型,旨在提升实时对话能力。该模型通过 Gemini Live API、Gemini Enterprise 以及 Search Live 和 Gemini Live 等产品向开发者、企业和公众提供。在多个基准测试中表现领先,并改进了语调理解和多语言支
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2519 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Google DeepMind 发布了 Gemini 3.1 Flash Live,这是其最高质量的音频和语音模型,旨在提升实时对话能力。该模型通过 Gemini Live API、Gemini Enterprise 以及 Search Live 和 Gemini Live 等产品向开发者、企业和公众提供。在多个基准测试中表现领先,并改进了语调理解和多语言支
Claude 应用发布更新,为 Pro 和 Max 用户提供计算机使用研究预览,集成于 Cowork 和 Claude Code 中。该功能允许 Claude 自主操作文件、开发工具和屏幕导航,无需额外设置,并增强了 Dispatch 的自动化能力。
Claude 应用发布更新,为 Pro 和 Max 用户提供通过手机或桌面端访问持久化代理线程的功能,用于管理 Cowork 中的任务。该功能作为研究预览推出,Max 用户今日可用,Pro 用户将在未来两天内逐步获得。
Flowise 发布 v3.1.0 版本,默认启用 HTTP 安全校验,阻止对不安全或内部域名的请求,以缓解 SSRF 攻击,并新增 HTTP SECURITY CHECK 和 HTTP DENY LIST 环境变量。该版本还包含 LangChain v1 迁移、AI SDK 升级、Azure Blob Storage 支持、AWS STS AssumeRo
智谱AI于2026年3月15日发布了GLM-5-Turbo基座模型,该模型针对OpenClaw龙虾场景进行了深度优化,强化了外部工具调用和多步任务稳定性,提升了复杂指令拆解、多智能体协同、时间理解及长任务执行效率。该模型旨在提升数据吞吐量大、逻辑链条长的任务处理能力。
百度千帆平台于2026年3月13日发布多项更新,包括新增多款Qwen3.5多模态模型、支持GLM-5和Kimi-K2.5的TPM配额购买,并升级Coding Plan至Kimi-K2.5且支持MiniMax-M2.5。同时,AI助手升级为智能调度模式,提供多模态问答能力,并新增百度热搜、百度搜索MCP版等工具。
Agent2Agent(A2A)协议发布 v1.0.0 版本,包含多项破坏性变更和新特性。主要变更包括合并推送通知配置、移除冗余字段、统一枚举格式、现代化 OAuth 2.0 流程(移除隐式/密码模式,增加设备码/PKCE),并新增任务列表方法、多租户支持等。该版本旨在提升协议的一致性、安全性和可扩展性,为代理间通信提供更稳定的基础。
Claude 更新了 Excel 和 PowerPoint 插件,使它们能共享对话上下文,实现跨应用操作联动。新增技能支持,并允许通过 LLM 网关连接 Amazon Bedrock、Google Cloud Vertex AI 和 Microsoft Foundry。
Google DeepMind 在 AlphaGo 战胜人类十周年之际,回顾了其影响:AlphaGo 的技术启发了 AlphaFold 解决蛋白质折叠问题,并获诺贝尔化学奖;AlphaProof 和 AlphaGeometry 2 在数学推理上达到国际数学奥林匹克银牌水平;AlphaEvolve 发现更高效的矩阵乘法算法;AI 协同科学家在抗菌素耐药性研究中
Claude App 发布更新,在 Cowork 中引入创建和调度周期性及按需任务的功能,并在 Claude Desktop 新增 Customize 部分,将技能、插件和连接器集中管理。
Google DeepMind 发布了 Gemini 3.1 Pro,这是 Gemini 3 系列的核心推理升级版,旨在解决科学、研究和工程领域的复杂任务。该模型已在开发者产品(如 Gemini API、AI Studio、Antigravity)和企业产品(如 Vertex AI、Gemini Enterprise)以及消费者应用(如 Gemini 应用和
Gemini API 于 2026 年 2 月 19 日发布 Gemini 3.1 Pro 预览版,这是 Gemini 3 系列的最新迭代。同时推出了独立的端点 gemini-3.1-pro-preview-customtools,该端点更擅长优先处理自定义工具,适用于混合使用 bash 和工具的用户。
LlamaIndex 发布 v0.14.15 版本,核心库新增多模态类型支持、多模态提示模板及格式化功能,并引入 AgentMesh 信任层集成。同时,Anthropic 和 Bedrock Converse 新增 Claude Sonnet 4.6 支持,Mistral AI 集成 Azure SDK,OCI Data Science 支持流式端点。此外,
Anthropic 发布了 Claude Sonnet 4.6,这是其最强大的 Sonnet 系列模型,在编码、计算机使用、长上下文推理、智能体规划、知识工作和设计方面均有全面升级。该模型在测试版中提供 1M token 的上下文窗口。Anthropic 通过博客文章详细介绍了该模型的发布。
Groq 宣布扩大其 GroqCloud 全球基础设施,以应对高性能 AI 推理需求的激增。作为扩张的一部分,Groq 与 Equinix 合作在英国推出了新的数据中心,为欧洲开发者提供低延迟、确定性的推理服务。GroqCloud 开发者数量已超过 350 万,生产流量持续增长。该扩张旨在支持实时 AI 应用,并改善总拥有成本。
百度千帆平台在2026年2月13日更新,新增GLM-5、Kimi-K2.5、MiniMax-M2.1深度思考模型,并支持自主规划Agent一键发布为秒哒插件,同时上线OpenClaw快速体验页面,新用户部署成功可获200元代金券。此外,工具广场推出AI论文功能,由百度文库、网盘与千帆团队联合打造,可一键将大纲扩展为高质量正文,提效50%以上。
智谱AI于2026年2月12日发布新一代旗舰模型GLM-5,专为复杂系统工程与长程Agent任务设计,实现从代码到工程的范式跃迁。该模型在后端架构设计、复杂算法实现及顽固Bug修复上展现出卓越的深度推理能力,在代码逻辑密度和系统工程能力上对标Claude Opus 4.5。GLM-5首次集成DeepSeek Sparse Attention,在保持长文本效果
Google DeepMind 发布 Gemini Deep Think 高级版本,与专家合作解决了 18 个研究问题中的长期瓶颈,涵盖算法、机器学习、组合优化、信息论和经济学等领域。该模型通过跨领域数学工具解决了 Max-Cut 和 Steiner Tree 等经典问题,推翻了 2015 年关于在线子模优化的猜想,并扩展了经济学中的启示原理。研究显示,AI
斯坦福大学 NLP 团队发布了 DSPy 3.1.3 版本,主要修复了 RLMs 和 GEPA 的多个问题,包括代码解释器、代码围栏解析、变量注入、工具序列化等,并更新了 GEPA 依赖以支持缓存评估和 Python 3.14。此外,该版本还稳定了真实 LM 测试,并处理了 ColBERTv2 服务器的错误响应。
百度千帆平台在2026年1月23日更新了模型服务,deepseek-v3.2-think支持交错思考,Anthropic API支持通过safety参数调整安全等级。在Agent开发方面,RAG功能新增支持Qwen-Embedding-4B模型,优化了文本解析与检索效果,并新增研报底稿功能及生成模式选择(性能优先与效果优先)。