返回主题地图

检索增强

技术方向 · 用外部知识约束模型输出的检索增强生成,含向量嵌入与重排序 · 共 258 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

5月19日周二 · 2 条
正文结构化主题已通过公开置信门槛
Dify Releases一手来源产品发布

Dify v1.14.2 发布:安全加固与工作流可靠性提升

Dify 发布 v1.14.2 补丁版本,重点进行安全加固、工作流可靠性提升、知识库稳定性修复以及部署和运行时调优。该版本加强了租户隔离和工具凭证安全,修复了工作流执行、RAG 管道和知识库的多个问题,并升级了插件守护进程和依赖。这些改进增强了 Dify 平台的安全性和稳定性,为后续的 Agent 功能奠定基础。

正文结构化主题已通过公开置信门槛
Microsoft AI Blog一手来源产品发布

Regis用AI减轻文书负担,让护理人员更专注居民照护

澳大利亚养老护理提供商Regis开发了基于微软Copilot Studio和Foundry的AI助手RegiCare Assist,用于自动总结护理记录并分类临床问题,以减少护理管理者的文书工作。该工具已在72家养老院中约150名员工中使用,使管理者能更快掌握居民状况,腾出更多时间直接护理。Regis强调AI仅作辅助,不替代临床判断,并计划未来与现有护理管理

5月12日周二 · 1 条
正文结构化主题已通过公开置信门槛
Dify Releases一手来源产品发布

Dify v1.14.1 发布:安全加固与工作流稳定性提升

Dify 发布 v1.14.1 补丁版本,重点进行安全加固、工作流与知识库稳定性提升、部署清理及 UI 平台迁移。安全方面包括自托管 SECRET KEY 强化、内部指标端点保护、修复 IDOR 问题及依赖升级(如 LiteLLM 修复 CVE-2026-42208)。工作流和知识库修复了多项稳定性问题,并优化了 RAG 去重逻辑。该版本旨在提升自托管部署的

5月5日周二 · 1 条
正文结构化主题已通过公开置信门槛
Gemini API Release Notes一手来源API 更新

Gemini API 文件搜索支持多模态与视觉引用

Gemini API 于 2026 年 5 月 5 日更新了文件搜索功能,支持多模态搜索,用户可通过 gemini-embedding-2 模型原生嵌入和搜索图像。此外,接地元数据现在包含用于视觉引用的 media id 和指示信息来源位置的 page numbers。

3月26日周四 · 1 条
正文结构化主题已通过公开置信门槛
LlamaIndex Releases一手来源产品发布

LlamaIndex v0.14.19 发布:多项修复与新增 MiniMax 集成

LlamaIndex 发布 v0.14.19 版本,包含多个包更新。核心修复包括在 BaseIndex.delete ref doc 中传递 delete from docstore 参数、保留 SQLDatabase.run sql 中的 CTE 名称、对齐同步检索去重键等。新增 MiniMax LLM 集成(默认 M2.7)、支持 GPT 5.4 Min

3月17日周二 · 1 条
正文结构化主题已通过公开置信门槛
LlamaIndex Releases一手来源产品发布

LlamaIndex v0.14.18 发布:弃用 Python 3.9 并修复多项核心问题

LlamaIndex 发布 v0.14.18 版本,核心更新包括对齐文本匹配过滤器、修复聊天引擎流式消费不完整时保留聊天历史、异步检索路径使用后处理节点、保留响应元数据、修复 Pydantic 输出解析器非 ASCII 模式描述等。同时,多个子包(如 agentmesh、azure、callbacks 系列)正式弃用 Python 3.9 支持。

3月11日周三 · 1 条
正文结构化主题已通过公开置信门槛
LlamaIndex Releases一手来源产品发布

LlamaIndex v0.14.16 发布:新增限流器与多模态重排序器

LlamaIndex 发布 v0.14.16 版本,包含多个核心修复和新功能,如新增令牌桶和滑动窗口限流器、多模态 LLM 重排序器、扩展向量存储元数据过滤器,并修复了多个 bug 和安全问题(CWE-502)。同时更新了多个集成包,包括 OpenAI、Anthropic、Bedrock 等,新增对 gpt-5-chat 和 reasoning conten

3月10日周二 · 1 条
正文结构化主题已通过公开置信门槛
Gemini API Release Notes一手来源模型发布

Gemini 发布多模态嵌入模型并宣布旧模型停用

Gemini API 于 2026 年 3 月 10 日发布了首个多模态嵌入模型 gemini-embedding-2-preview,支持文本、图像、视频、音频和 PDF 输入,并将所有模态映射到统一的嵌入空间。同时,Gemini 宣布 gemini-2.5-flash-lite-preview-09-2025 模型将于 2026 年 3 月 31 日关闭

2月4日周三 · 1 条
正文结构化主题已通过公开置信门槛
Flowise Releases一手来源产品发布

Flowise v3.0.13 发布:新增多节点与安全修复

Flowise 发布 v3.0.13 版本,新增了多个节点功能,包括 Azure Rerankers、ChatCerebras 集成增强、Cloudflare Workers AI 和 Ollama Cloud 支持等。核心改进包括文件上传的 MIME 类型验证、API 密钥权限、密码安全增强以及弃用 LlamaIndex。此外,修复了多个安全漏洞和 bug

1月23日周五 · 1 条
正文结构化主题已通过公开置信门槛
Baidu Qianfan Changelog一手来源产品发布

百度千帆更新:DeepSeek交错思考、RAG增强及研报功能

百度千帆平台在2026年1月23日更新了模型服务,deepseek-v3.2-think支持交错思考,Anthropic API支持通过safety参数调整安全等级。在Agent开发方面,RAG功能新增支持Qwen-Embedding-4B模型,优化了文本解析与检索效果,并新增研报底稿功能及生成模式选择(性能优先与效果优先)。

1月19日周一 · 1 条
正文结构化主题已通过公开置信门槛
DSPy Releases一手来源产品发布

DSPy 3.1.2 发布:修复 RAG 教程与 JSON 解析,增强 Parallel 参数

DSPy 发布了 3.1.2 维护版本,主要修复了 RAG 教程中的下载问题、改进了 JSON 解析(移除了初始正则提取),并更新了设置保存/加载方法。此外,Parallel 组件新增了 timeout 和 straggler limit 参数,CI 流程也进行了调整。该版本包含来自新贡献者的代码,提升了库的稳定性和可用性。

1月16日周五 · 1 条
正文结构化主题已通过公开置信门槛
Baidu Qianfan Changelog一手来源产品发布

百度千帆更新:新增算力单元、JSON输出及DeepResearch策略

百度千帆平台于2026年1月16日发布多项更新:新增广州地域AI加速卡算力单元,Responses API支持配置JSON输出格式,上线自定义接入点管控API;Agent开发方面,RAG数据库支持多sheet页文件上传解析,DeepResearch API新增报告生成策略配置,提供性能优先和效果优先两种模式。

12月5日周五 · 1 条
正文结构化主题已通过公开置信门槛
Baidu Qianfan Changelog一手来源产品发布

百度千帆平台更新:模型服务增强与工具广场新增多项AI服务

百度千帆平台在2025年12月5日更新了多项模型服务,包括DeepSeek-V3.2等模型支持拆分TPM配额购买,DeepSeek-V3.2-Think等支持通过thinking budget控制思维链长度,并新增Qwen3-30B-A3B-Instruct-2507等模型导入部署。同时,工具广场新增AI纪要、视频AI笔记、题目解析MCP等多项服务,并更新了

10月24日周五 · 1 条
正文结构化主题已通过公开置信门槛
Baidu Qianfan Changelog一手来源产品发布

百度千帆更新:新增视觉模型、RAG增强及工作流优化

百度千帆平台于2025年10月24日发布多项更新,包括支持InternVL3.5-14B模型导入部署,上线Qwen3-VL系列视觉理解模型,并增强deepseek-v3.2的FIM补全和前缀续写功能。同时,知识库检索API简化参数并支持知识图谱开关,新增法律法条解析模板,以及高中作文打分和AI绘本组件。此外,工作流对话接口超时限制延长至30分钟,并新增撤销/

9月16日周二 · 1 条
正文结构化主题已通过公开置信门槛
Gemini API Release Notes一手来源API 更新

谷歌宣布10月停用三个旧版嵌入模型

谷歌宣布将于2025年10月停用三个旧版嵌入模型:embedding-001、embedding-gecko-001和gemini-embedding-exp-03-07。用户需迁移至最新的嵌入模型,详情参见Embeddings页面。

7月25日周四 · 1 条
正文结构化主题已通过公开置信门槛
Chip Huyen Blog观点

构建生成式 AI 平台:通用架构与关键组件解析

Chip Huyen 在博客中概述了构建生成式 AI 平台的通用架构,从最简单的查询-模型响应开始,逐步添加上下文增强(如 RAG)、护栏、模型路由、缓存等组件,并强调可观测性和编排的重要性。文章指出上下文构建类似于经典机器学习中的特征工程,RAG 是常见的上下文增强模式,并介绍了基于术语和基于嵌入的检索方法。该架构旨在帮助企业高效部署生成式 AI 应用,提

3月14日周四 · 1 条
正文结构化主题已通过公开置信门槛
Chip Huyen Blog研究

Chip Huyen 分析 900 个热门开源 AI 工具:应用开发层增长最快

Chip Huyen 分析了 900 个最受欢迎的开源 AI 工具,发现 AI 技术栈分为基础设施、模型开发和应用开发三层,其中应用开发层在 2023 年增长最快。她指出,应用开发中的 AI 工程领域(如提示工程、AI 接口、代理框架)成为热点,而模型开发层的增长主要来自推理优化。此外,她观察到中国开源生态与西方存在显著差异,且 2023 年 9 月后新工具

1月3日周一 · 1 条
正文结构化主题已通过公开置信门槛
Jay Alammar研究

图解检索增强Transformer:RETRO如何以4%参数媲美GPT-3

DeepMind 的 RETRO 模型通过检索数据库增强语言模型,以 7.5B 参数达到 GPT-3 的性能,仅为后者规模的 4%。该模型将事实知识存储在外部数据库中,减少参数负担,训练更快且部署成本更低。文章强调构建更大模型并非提升性能的唯一途径,检索增强是重要方向。