返回主题地图

检索增强

技术方向 · 用外部知识约束模型输出的检索增强生成,含向量嵌入与重排序 · 共 258 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

9月23日周三 · 4 条
正文结构化主题已通过公开置信门槛
arXiv cs.IR一手来源研究1

Knowledge-as-Skill:LLM 智能体自主使用知识库的结构设计

该论文提出 Knowledge-as-Skill 结构设计,让 LLM 智能体能够自主发现、导航和使用知识库,而非依赖传统 RAG 的固定检索-拼接-生成流程。设计包含 SKILL.md 发现层、每目录 index.md 导航层和带 YAML frontmatter 的知识层,遵循 Open Knowledge Format 与 Skill 协议。在 Wix

正文结构化主题已通过公开置信门槛
arXiv cs.IR一手来源研究1

ReFilter:结合嵌入与LLM过滤检索相似移动应用

多伦多大学等机构的研究者提出 ReFilter,一个混合框架,先用嵌入向量检索语义相近的移动应用候选集,再用大语言模型进行上下文过滤,以识别真正功能相似的应用。该方法在检索相似应用任务上取得 90% 的 F1 分数,兼顾效率与精度,可支持应用对比、竞品分析和推荐。作者称这是首个将上下文感知的 LLM 过滤应用于大规模应用检索的研究。

正文结构化主题已通过公开置信门槛
arXiv cs.CV一手来源研究1

从EEG重建视觉刺激:基于GAN的脑到图像生成基线研究

该研究在 THINGS-EEG2 数据集上提出一个可复现的单被试基线,用紧凑的时空卷积编码器将重复平均后的 EEG 映射到 ViT-B/32 图像特征,测试 EEG 能否在视觉嵌入空间中检索到所看刺激。三个随机种子下,模型在 200 类测试集上取得显著高于随机水平的图像召回率(1/5/10),但跨被试迁移性能骤降,且从随机初始化直接训练的条件生成器输出以噪声

正文结构化主题已通过公开置信门槛
arXiv cs.CL一手来源研究1

检索片段训练实现高效 QMSum 查询聚焦会议摘要

该论文针对 QMSum 查询聚焦会议摘要任务,指出该基准缺少统一评分器导致结果难以比较,因此在一个实现下重新评分或生成 15 个系统并发布逐查询预测。核心发现是训练与推理输入对齐很关键:一个 406M Fusion-in-Decoder 专用模型从长输入切换到 2000 词检索片段后损失 6.30 ROUGE-1,但在该片段机制上微调后可恢复,测试得分 36

9月22日周二 · 4 条
正文结构化主题已通过公开置信门槛
arXiv cs.IR一手来源研究

跨引擎AI搜索引用差异显著:无引擎评分难以预测可见性

该研究通过2026年6月6日对ChatGPT、Microsoft Copilot、Google和Perplexity四个AI搜索界面的观测审计,用15个商业提示词收集了589条引用观测,发现同一提示词下跨引擎的URL重叠极低(平均Jaccard相似度仅0.0079,84.9%的引擎对无共享URL),96.4%的URL只出现在一个引擎中。研究指出,不依赖引擎的

正文结构化主题已通过公开置信门槛
arXiv cs.IR一手来源研究

参数化稠密-稀疏融合混合检索:在BEIR SciFact上基于Qdrant调优排名-分数混合

该论文研究了一种参数化混合检索排序器,将稠密嵌入列表与稀疏词法列表融合,包含稠密先验、分数-排名混合、RRF平滑、列表几何系数和路由边距等显式参数。作者在SciFact训练集(809查询)上网格搜索参数,冻结后在测试集(300查询)上评估,调优后的排名-分数混合达到0.753 nDCG@10和0.889 recall@10,优于稠密BGE(0.742/0.8

正文结构化主题已通过公开置信门槛
arXiv cs.CL一手来源研究

面向个人记忆检索的零推理前瞻性记忆项

论文提出一种零推理成本的"前瞻性记忆检索"机制:将用户的承诺以带日期或触发条件的条目存入显式账本,当条目触发时,与之关联的记忆项获得显著性加成,并以乘法方式融入基于嵌入的检索,从而在查询时不运行任何模型。在仿照 TriggerBench 结构构建的合成任务集(48 段盲写对话、175 个任务)上,该机制将困难层的 recall@5 从 0.000 提升至默认

正文结构化主题已通过公开置信门槛
LlamaIndex Releases一手来源开源

LlamaIndex v0.14.25 发布:核心更新与安全修复

LlamaIndex 发布 v0.14.25 版本,核心包 llama-index-core 更新至 0.14.25,移除了已弃用的 ipex-llm 和 optimum-intel IPEX 集成,修复了元数据替换、流式工具调用、函数工具重试等问题,并为 StructuredLLMRerank 增加原生异步支持。同时,大量 agent、callbacks、

9月21日周一 · 5 条
正文结构化主题已通过公开置信门槛
arXiv cs.IR一手来源研究

验证而非信任:面向大规模视频发现检索的智能体模型开发

论文提出 EvoPilot,一种面向长周期在线自动研究的人类把关方法,通过版本化领域技能、类型化适配器和确定性检查来验证实验结果。在 Video Deep Dive 的 37 天检索模型开发中,早期自动研究错误地将 22 个百分点的离线命中率下降归因于交互头,EvoPilot 验证后发现是评估缺陷导致输出深度异常,修复后匹配比较显示离线提升 3.20 个百分

正文结构化主题已通过公开置信门槛
arXiv cs.IR一手来源研究

多跳检索可预测失败:分数分布置信度评分与弃答

该论文研究多跳检索中的失败预测问题,提出CWAR可归约性定理和特征机制互补性命题,证明检索失败在结构上可预测且不同失败机制下主导特征不同。作者提出RegimeAbstain方法,利用最多九个查询-ANN结构特征计算检索置信度分数,无需额外LLM调用即可实现校准弃答策略。在MuSiQue、2WikiMultiHopQA、HoVer三个基准和两种检索架构上,该方

正文结构化主题已通过公开置信门槛
arXiv cs.IR一手来源研究

超大规模个性化搜索的混合GPU-CPU检索系统

该论文提出一种混合 GPU-CPU 协同服务系统,用于超大规模个性化搜索。系统通过 GPU 路径在约十亿文档的精选库存上融合检索与交互预排序,CPU 路径在约二十倍大的库存上进行轻量级个性化评分,两条路径可按请求独立运行并去重后共享下游排序。生产环境 A/B 测试显示,相比原有纯 CPU 配置,模型评分相关性和实质互动均有提升,验证了深度-广度分离架构的实用

正文结构化主题已通过公开置信门槛
arXiv cs.SE一手来源研究

代码漏洞模型在语义保持变换下的嵌入漂移

该研究基于 Big-Vul 构建了 7,500 对 C/C++ 漏洞-补丁函数(共 15,000 个函数),对两类样本施加四种保持语义的变异(删注释、插入死代码、重命名变量与重写循环、以及全部组合),并用冻结的 microsoft/codebert-base 嵌入配合六种分类器评估。结果显示组合变异下基线 Vulnerable Flip Rate(VFR)达

正文结构化主题已通过公开置信门槛
arXiv cs.CV一手来源研究

MAGIC:基于最优传输的边际引导压缩用于高效视觉文档检索

该论文提出 MAGIC,一种无需训练的事后压缩方法,用于提升视觉文档检索(VDR)效率。针对 ColPali 等多向量检索系统中 patch 级向量带来的存储与 MaxSim 计算开销,MAGIC 通过估计检索需求并构建双边际熵最优传输问题,在压缩时优先保留高使用率 patch 并均衡保留 facet 的使用。在 ViDoRe 基准上,MAGIC 在多种保留

9月18日周五 · 3 条
正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源教程

将多模型 AI 智能体迁移至 Amazon Bedrock AgentCore runtime

AWS 博客介绍如何将基于 Hugging Face smolagents 构建的多模型医疗 AI 智能体从自管理的 Amazon ECS/Fargate 迁移到 Amazon Bedrock AgentCore runtime。迁移后由 AgentCore 托管容器生命周期、扩缩容、身份与可观测性,同时保留三模型编排(SageMaker 上的 BioM-E

正文结构化主题已通过公开置信门槛
THE DECODER产品发布

OpenAI 推出 Astra for Law 进军法律市场

OpenAI 推出面向法律工作的 Astra for Law,基于 GPT-6 Astra 模型,并搭配覆盖美国判例法、法规的法律检索索引,索引包含超过 2.3 亿个 URL,数据来自 Free Law Project。在 OpenAI 自行使用 Vals AI 法律研究基准的测试中,Astra for Law 通过 200 道题中的 54%,高于 GPT-

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

IDC:360亿方智能私有化市场第二,增速第一

IDC发布《中国智能企业内容与知识平台市场份额,1H26》报告,2026年上半年中国该市场规模达10.86亿元,同比增长19.0%,其中私有化部署市场4.11亿元,同比增长27.3%。360亿方智能整体市场份额位列第四、同比增长36.2%,在私有化部署市场位列第二、同比增长48.8%,为前三大厂商中增速第一。报告指出企业需求正从企业网盘、内容管理等单点采购转

9月17日周四 · 4 条
正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源教程

为 Amazon Bedrock 知识库选择向量存储

AWS Machine Learning Blog 发布文章,指导用户为 Amazon Bedrock Knowledge Bases 的客户自管配置选择向量存储后端。文章对比了 Amazon OpenSearch Service、Amazon Aurora PostgreSQL with pgvector 和 Amazon S3 Vectors 三种后端,

正文结构化主题已通过公开置信门槛
Google Gen AI JavaScript SDK Releases一手来源API 更新

Google Gen AI JavaScript SDK 发布 v2.23.0

Google 发布 Gen AI JavaScript SDK v2.23.0,新增凭证 API 资源、交互 schema 中的 RetrievalCallStep 与 RetrievalResultStep、跨 Python 和 TypeScript SDK 的环境文件上传下载,以及 HttpOptions 自定义 fetch 支持。这些更新扩展了 SDK

正文结构化主题已通过公开置信门槛
Google Gen AI Python SDK Releases一手来源API 更新

Google Gen AI Python SDK 发布 v2.24.0

Google 发布 Gen AI Python SDK v2.24.0,新增凭证(credential)API 资源并接入 SDK,同时在 interactions schema 中加入 RetrievalCallStep 和 RetrievalResultStep,并实现 Python 与 TypeScript SDK 的环境文件上传下载。此外修复了自动函

正文结构化主题已通过公开置信门槛
CrewAI Releases一手来源开源

CrewAI 发布 1.15.22:新增模型路由与 OpenRouter 嵌入支持

CrewAI 发布 1.15.22 版本,新增支持别名作为连接标识、记录部署创建失败原因、在追踪中收集人类反馈与暂停事件,并引入 llm overlay 上下文变量用于将 agent 角色路由到不同模型,同时新增 OpenRouter 作为嵌入提供商。该版本还修复了大量 bug,涵盖 Azure 流式工具调用、Gemini 文件内容保留、OpenAI 推理模