Google 发布 MedGemma 27B 多模态模型与 MedSigLIP 编码器
Google DeepMind 宣布推出 MedGemma 系列中的两个新开放模型:MedGemma 27B 多模态模型和 MedSigLIP 图像编码器。这些模型旨在支持医疗 AI 开发,可处理文本和图像输入,并能在单 GPU 上运行。它们基于 Gemma 3 构建,并经过医学数据优化,同时保留通用能力。开发者可下载、微调并部署到 Vertex AI,已有
公司与模型 · Hugging Face 开源社区动态:热门模型与数据集、排行榜变化与开源生态的晴雨表
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 10:55
Google DeepMind 宣布推出 MedGemma 系列中的两个新开放模型:MedGemma 27B 多模态模型和 MedSigLIP 图像编码器。这些模型旨在支持医疗 AI 开发,可处理文本和图像输入,并能在单 GPU 上运行。它们基于 Gemma 3 构建,并经过医学数据优化,同时保留通用能力。开发者可下载、微调并部署到 Vertex AI,已有
Qwen团队发布了Qwen3Guard,这是Qwen系列首个安全护栏模型,基于Qwen3微调,支持提示和响应的安全分类,并提供风险等级和分类标签。该模型提供Gen和Stream两种变体,分别用于离线标注和实时流式检测,支持119种语言,并已在Hugging Face和ModelScope开源。Qwen3Guard在安全基准上达到先进水平,并可通过阿里云AI护
腾讯开源了 Hunyuan-A13B 大语言模型,采用细粒度 MoE 架构,总参数 800 亿,激活参数 130 亿,支持 256K 上下文和混合推理模式。该模型在数学、科学和智能体等基准测试中表现优异,并提供了技术报告和训练推理手册。
Chip Huyen 分析了 900 个最受欢迎的开源 AI 工具,发现 AI 技术栈分为基础设施、模型开发和应用开发三层,其中应用开发层在 2023 年增长最快。她指出,应用开发中的 AI 工程领域(如提示工程、AI 接口、代理框架)成为热点,而模型开发层的增长主要来自推理优化。此外,她观察到中国开源生态与西方存在显著差异,且 2023 年 9 月后新工具
Jay Alammar加入Cohere团队近一年,该公司训练大规模语言模型(GPT和BERT类)并通过API提供,支持微调。他撰写了多篇文章,介绍如何应用这些模型解决实际问题,包括提示工程、语义搜索、微调等。这些内容旨在帮助开发者和企业更好地使用大规模语言模型。