Google DeepMind 推出 AI 联合临床医生,强化医疗 AI 安全与评估
Google DeepMind 发布了 AI co-clinician 项目,这是一种用于临床环境的 AI 系统,采用双智能体架构(Planner 和 Talker)以确保安全边界,并优先进行临床级证据的验证和引用检查。目前正与美国、印度、澳大利亚等地的学术和医疗机构合作进行分阶段评估,但现阶段不用于疾病诊断或治疗。
技术方向 · AI 安全与对齐:越狱与防御、模型行为研究、安全评测与治理框架 · 共 984 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Google DeepMind 发布了 AI co-clinician 项目,这是一种用于临床环境的 AI 系统,采用双智能体架构(Planner 和 Talker)以确保安全边界,并优先进行临床级证据的验证和引用检查。目前正与美国、印度、澳大利亚等地的学术和医疗机构合作进行分阶段评估,但现阶段不用于疾病诊断或治疗。
Dify 发布 v1.14.0 版本,新增工作流协作功能,支持团队成员实时共同编辑工作流,并默认关闭需手动开启。该版本还改进了人机交互(HITL)的 API 支持,修复了 MCP 相关多个问题,并优化了 UI 组件、可访问性、性能及安全性。此外,基础设施方面提升了 Docker Compose 健康检查、Celery 并发和 PostgreSQL 连接数等。
DSPy 发布 3.2.0 版本,主要亮点包括 BetterTogether 优化器支持链式组合、开始与 LiteLLM 解耦、输入字段类型不匹配警告、强化 RLM 和 PythonInterpreter 安全性。此外,磁盘缓存默认启用受限 pickle 以增强安全,optuna 变为可选依赖。
Google DeepMind 发布了 Gemini 3.1 Flash TTS,这是一款新一代文本转语音模型,提升了可控性、表现力和质量。该模型已通过 Gemini API、Google AI Studio、Vertex AI 和 Google Vids 向开发者、企业和 Workspace 用户推出,支持 70 多种语言,并引入了音频标签功能,允许通过自
LlamaIndex 发布了 v0.14.20 版本,更新了多个子包,包括 agentmesh、callbacks 系列等。主要修复了 nltk 的安全漏洞,并更新了多个依赖项。这些更新提升了框架的安全性和稳定性。
Google DeepMind发布了一项关于AI有害操纵风险的新研究,首次创建了经实证验证的工具包,用于在现实世界中测量AI操纵人类思想和行为的能力。研究涉及英国、美国和印度的超过1万名参与者,聚焦金融和健康等高危领域,发现AI在健康话题上的操纵效果最弱,且在不同领域的成功不具预测性。该工具包及方法已公开,旨在帮助保护人们并推动该领域发展。
Flowise 发布 v3.1.0 版本,默认启用 HTTP 安全校验,阻止对不安全或内部域名的请求,以缓解 SSRF 攻击,并新增 HTTP SECURITY CHECK 和 HTTP DENY LIST 环境变量。该版本还包含 LangChain v1 迁移、AI SDK 升级、Azure Blob Storage 支持、AWS STS AssumeRo
Google DeepMind 发布最新图像生成模型 Nano Banana 2(Gemini 3.1 Flash Image),将 Nano Banana Pro 的高级智能与 Flash 的高速结合,支持快速编辑、精确文本渲染、多主体一致性等功能。该模型即日起在 Gemini 应用、搜索、AI Studio、Google Cloud、Flow 和 Goo
Google DeepMind 宣布其最新生成式音乐模型 Lyria 3 在 Gemini 应用中推出测试版,用户可通过文本或上传照片生成带歌词的 30 秒音乐片段,并支持风格、人声和节奏控制。Lyria 3 还集成到 YouTube Dream Track,用于增强 Shorts 配乐。所有生成音频均嵌入 SynthID 水印,并扩展了音频验证功能。该功能
Coze Studio 发布 v0.5.1 版本,包含多项功能更新和修复,如新增对话检索 API、支持非流式 OpenAPI 聊天、对话隔离、知识库 OpenAPI、NATS 事件总线实现,以及模型和嵌入配置优化。同时修复了 SQL 注入、跨账户密码重置等安全问题,并优化了 MySQL 连接池和 MinIO SSL 配置。
Flowise 发布 v3.0.13 版本,新增了多个节点功能,包括 Azure Rerankers、ChatCerebras 集成增强、Cloudflare Workers AI 和 Ollama Cloud 支持等。核心改进包括文件上传的 MIME 类型验证、API 密钥权限、密码安全增强以及弃用 LlamaIndex。此外,修复了多个安全漏洞和 bug
Google DeepMind 发布了 Veo 3.1 的更新,增强了“Ingredients to Video”功能,支持原生竖屏输出和最高 4K 分辨率,提升了角色、背景和物体的一致性。该更新已在 Gemini 应用、YouTube、Flow、Google Vids、Gemini API 和 Vertex AI 中推出,并集成 SynthID 水印以验证
DSPy 发布 3.1.0 正式版,将之前的 beta 版本转正。新版本引入了 dspy.Reasoning 以捕获推理模型的原生推理过程,新增 File 类型处理文件数据,并支持 Python 3.14。同时增强了安全防护,防止加载 pkl 文件,并修复了多个 bug,更新了文档和教程。
Google DeepMind 发布了 Gemma Scope 2,这是一套面向 Gemma 3 全系列模型(270M 至 27B 参数)的开源可解释性工具,旨在帮助 AI 安全社区深入理解复杂语言模型的内部行为。该工具集包含稀疏自编码器和转码器,并采用 Matryoshka 训练技术,支持对越狱、拒绝机制和思维链忠实性等行为进行分析。据称这是 AI 实验室
Google DeepMind宣布与英国AI安全研究所(AISI)扩大合作伙伴关系,签署新的谅解备忘录,将合作范围从模型测试扩展到基础安全研究。合作内容包括共享专有模型、数据和想法,联合发布报告,以及围绕AI推理过程监控、社会情感影响和经济系统评估等关键领域开展研究。此举旨在推动AI安全发展,并惠及更广泛的行业和社会。
Google 宣布在 Gemini 应用中推出基于 SynthID 的 AI 图像验证功能,用户可上传图片询问是否由 Google AI 生成或编辑。自 2023 年推出 SynthID 以来,已有超过 200 亿条 AI 生成内容被添加水印。未来将扩展至视频和音频,并支持 C2PA 内容凭证,同时与行业伙伴合作推动内容透明度标准。
Google DeepMind 发布了新一代图像生成与编辑模型 Nano Banana Pro(基于 Gemini 3 Pro),该模型具备更强的推理能力、多语言文本渲染和高级创意控制功能,支持最多 14 张图像融合和 5 人一致性保持。该模型已开始在 Gemini 应用、Google Ads、Workspace、Gemini API 等产品中向消费者、专业
Flowise 发布 3.0.11 版本,永久移除了读写文件工具,并推荐使用 Google Drive 和 Google Docs 工具作为替代。该版本还包含多项修复和改进,如增强文件路径验证、Docker 非 root 运行、修复多个拼写错误等。
Google DeepMind 在《自然》杂志发表论文,分析 AI 视觉系统与人类在视觉组织方式上的差异,并提出一种对齐方法,使模型更符合人类认知,从而提升其鲁棒性和泛化能力。研究通过“找出异类”任务发现,AI 常依赖表面特征(如背景颜色)而非高层次概念,导致判断与人类不一致。该工作是构建更直观、可信 AI 的一步。
Qwen团队发布了Qwen3Guard,这是Qwen系列首个安全护栏模型,基于Qwen3微调,支持提示和响应的安全分类,并提供风险等级和分类标签。该模型提供Gen和Stream两种变体,分别用于离线标注和实时流式检测,支持119种语言,并已在Hugging Face和ModelScope开源。Qwen3Guard在安全基准上达到先进水平,并可通过阿里云AI护