Dify v1.14.2 发布:安全加固与工作流可靠性提升
Dify 发布 v1.14.2 补丁版本,重点进行安全加固、工作流可靠性提升、知识库稳定性修复以及部署和运行时调优。该版本加强了租户隔离和工具凭证安全,修复了工作流执行、RAG 管道和知识库的多个问题,并升级了插件守护进程和依赖。这些改进增强了 Dify 平台的安全性和稳定性,为后续的 Agent 功能奠定基础。
技术方向 · 用外部知识约束模型输出的检索增强生成,含向量嵌入与重排序 · 共 258 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Dify 发布 v1.14.2 补丁版本,重点进行安全加固、工作流可靠性提升、知识库稳定性修复以及部署和运行时调优。该版本加强了租户隔离和工具凭证安全,修复了工作流执行、RAG 管道和知识库的多个问题,并升级了插件守护进程和依赖。这些改进增强了 Dify 平台的安全性和稳定性,为后续的 Agent 功能奠定基础。
澳大利亚养老护理提供商Regis开发了基于微软Copilot Studio和Foundry的AI助手RegiCare Assist,用于自动总结护理记录并分类临床问题,以减少护理管理者的文书工作。该工具已在72家养老院中约150名员工中使用,使管理者能更快掌握居民状况,腾出更多时间直接护理。Regis强调AI仅作辅助,不替代临床判断,并计划未来与现有护理管理
Dify 发布 v1.14.1 补丁版本,重点进行安全加固、工作流与知识库稳定性提升、部署清理及 UI 平台迁移。安全方面包括自托管 SECRET KEY 强化、内部指标端点保护、修复 IDOR 问题及依赖升级(如 LiteLLM 修复 CVE-2026-42208)。工作流和知识库修复了多项稳定性问题,并优化了 RAG 去重逻辑。该版本旨在提升自托管部署的
Gemini API 于 2026 年 5 月 5 日更新了文件搜索功能,支持多模态搜索,用户可通过 gemini-embedding-2 模型原生嵌入和搜索图像。此外,接地元数据现在包含用于视觉引用的 media id 和指示信息来源位置的 page numbers。
LlamaIndex 发布 v0.14.19 版本,包含多个包更新。核心修复包括在 BaseIndex.delete ref doc 中传递 delete from docstore 参数、保留 SQLDatabase.run sql 中的 CTE 名称、对齐同步检索去重键等。新增 MiniMax LLM 集成(默认 M2.7)、支持 GPT 5.4 Min
LlamaIndex 发布 v0.14.18 版本,核心更新包括对齐文本匹配过滤器、修复聊天引擎流式消费不完整时保留聊天历史、异步检索路径使用后处理节点、保留响应元数据、修复 Pydantic 输出解析器非 ASCII 模式描述等。同时,多个子包(如 agentmesh、azure、callbacks 系列)正式弃用 Python 3.9 支持。
LlamaIndex 发布 v0.14.16 版本,包含多个核心修复和新功能,如新增令牌桶和滑动窗口限流器、多模态 LLM 重排序器、扩展向量存储元数据过滤器,并修复了多个 bug 和安全问题(CWE-502)。同时更新了多个集成包,包括 OpenAI、Anthropic、Bedrock 等,新增对 gpt-5-chat 和 reasoning conten
Gemini API 于 2026 年 3 月 10 日发布了首个多模态嵌入模型 gemini-embedding-2-preview,支持文本、图像、视频、音频和 PDF 输入,并将所有模态映射到统一的嵌入空间。同时,Gemini 宣布 gemini-2.5-flash-lite-preview-09-2025 模型将于 2026 年 3 月 31 日关闭
Flowise 发布 v3.0.13 版本,新增了多个节点功能,包括 Azure Rerankers、ChatCerebras 集成增强、Cloudflare Workers AI 和 Ollama Cloud 支持等。核心改进包括文件上传的 MIME 类型验证、API 密钥权限、密码安全增强以及弃用 LlamaIndex。此外,修复了多个安全漏洞和 bug
百度千帆平台在2026年1月23日更新了模型服务,deepseek-v3.2-think支持交错思考,Anthropic API支持通过safety参数调整安全等级。在Agent开发方面,RAG功能新增支持Qwen-Embedding-4B模型,优化了文本解析与检索效果,并新增研报底稿功能及生成模式选择(性能优先与效果优先)。
DSPy 发布了 3.1.2 维护版本,主要修复了 RAG 教程中的下载问题、改进了 JSON 解析(移除了初始正则提取),并更新了设置保存/加载方法。此外,Parallel 组件新增了 timeout 和 straggler limit 参数,CI 流程也进行了调整。该版本包含来自新贡献者的代码,提升了库的稳定性和可用性。
百度千帆平台于2026年1月16日发布多项更新:新增广州地域AI加速卡算力单元,Responses API支持配置JSON输出格式,上线自定义接入点管控API;Agent开发方面,RAG数据库支持多sheet页文件上传解析,DeepResearch API新增报告生成策略配置,提供性能优先和效果优先两种模式。
百度千帆平台在2025年12月5日更新了多项模型服务,包括DeepSeek-V3.2等模型支持拆分TPM配额购买,DeepSeek-V3.2-Think等支持通过thinking budget控制思维链长度,并新增Qwen3-30B-A3B-Instruct-2507等模型导入部署。同时,工具广场新增AI纪要、视频AI笔记、题目解析MCP等多项服务,并更新了
百度千帆平台于2025年10月24日发布多项更新,包括支持InternVL3.5-14B模型导入部署,上线Qwen3-VL系列视觉理解模型,并增强deepseek-v3.2的FIM补全和前缀续写功能。同时,知识库检索API简化参数并支持知识图谱开关,新增法律法条解析模板,以及高中作文打分和AI绘本组件。此外,工作流对话接口超时限制延长至30分钟,并新增撤销/
谷歌宣布将于2025年10月停用三个旧版嵌入模型:embedding-001、embedding-gecko-001和gemini-embedding-exp-03-07。用户需迁移至最新的嵌入模型,详情参见Embeddings页面。
Chip Huyen 在博客中概述了构建生成式 AI 平台的通用架构,从最简单的查询-模型响应开始,逐步添加上下文增强(如 RAG)、护栏、模型路由、缓存等组件,并强调可观测性和编排的重要性。文章指出上下文构建类似于经典机器学习中的特征工程,RAG 是常见的上下文增强模式,并介绍了基于术语和基于嵌入的检索方法。该架构旨在帮助企业高效部署生成式 AI 应用,提
Chip Huyen 分析了 900 个最受欢迎的开源 AI 工具,发现 AI 技术栈分为基础设施、模型开发和应用开发三层,其中应用开发层在 2023 年增长最快。她指出,应用开发中的 AI 工程领域(如提示工程、AI 接口、代理框架)成为热点,而模型开发层的增长主要来自推理优化。此外,她观察到中国开源生态与西方存在显著差异,且 2023 年 9 月后新工具
DeepMind 的 RETRO 模型通过检索数据库增强语言模型,以 7.5B 参数达到 GPT-3 的性能,仅为后者规模的 4%。该模型将事实知识存储在外部数据库中,减少参数负担,训练更快且部署成本更低。文章强调构建更大模型并非提升性能的唯一途径,检索增强是重要方向。