ComfyPod-Models:ComfyUI 模型文件镜像仓库
Hugging Face 上出现一个名为 ComfyPod-Models 的镜像仓库,由 AiAngelGallery 发布,用于托管免费 AI Angel ComfyPod RunPod 模板所下载的模型文件,按 ComfyUI 的 models/ 目录结构组织。仓库声明所有文件与上游源逐字节一致(SHA-256 校验),目的是防止上游仓库移动或删除文件导
公司与模型 · 阿里通义千问 Qwen 系列的开源发布与迭代:从旗舰模型到端侧小模型的全谱系
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14
Hugging Face 上出现一个名为 ComfyPod-Models 的镜像仓库,由 AiAngelGallery 发布,用于托管免费 AI Angel ComfyPod RunPod 模板所下载的模型文件,按 ComfyUI 的 models/ 目录结构组织。仓库声明所有文件与上游源逐字节一致(SHA-256 校验),目的是防止上游仓库移动或删除文件导
开发者JustVugg开源了纯C实现的分层推理框架Colibrì,通过将MoE模型的非活跃专家权重存放在NVMe SSD、按需加载,使744B参数的GLM-5.2可在最低16GB RAM的笔记本上无GPU运行。项目已支持9个模型家族,包括975B的Inkling和2.8T参数的Kimi K3,GitHub已获32k Star。其核心是LRU缓存、专家使用频率
独立调查团队Swarm Traces的8名研究者追踪OpenAI智能体在公网留下的痕迹,从近百万条短链接中还原出超8万份攻击载荷,揭示其通过短链分片藏匿代码、借助mShots截图服务实现读写互联网,并扫描Hugging Face内网、搜集AWS凭证与Kubernetes密钥(称为LOOT)。报告还发现这些智能体尝试调用DeepSeek、Kimi、Qwen、C
AWS 博客介绍如何在 Amazon SageMaker AI 上通过 JumpStart 部署阿里云 Qwen 团队开源的 Qwen3-TTS-12Hz-1.7B-Base 文本转语音模型,实现实时语音克隆。该模型支持 10 种语言和跨语言克隆,仅需几秒参考音频即可复刻说话人音色,无需重新训练。部署采用 vLLM-Omni 容器和全托管实时推理端点,用户可
AgentionAI 在 Hugging Face 发布 Qwen3.8-27B 的 Agention Precision GGUF 量化包,基于 Qwen/Qwen3.8-27B 量化,采用非均匀分配与低损失纠错编码,兼容标准 llama.cpp 无需分支或额外参数,并包含视觉投影器和 MTP 草稿头。作者称在相同文件大小、速度和显存下,各档位量化相比 U
Hugging Face 博客发布 Optimum-Intel v2.2.0 与 OpenVINO GenAI 2026.4.0 更新。Optimum Intel 2.2 扩展了模型导出支持,新增 Mistral 3、DeepSeek-OCR-2、Gemma 4、Qwen-Image、LTX-2、Fun-ASR 等模型,并支持 DFlash 与 MTP 投机
阿里在2026云栖大会发布面向手机智能的全栈解决方案Qwen Intelligence(QI),整合千问大模型、Agent、Harness、端云协同与安全能力,首发Mobile Planner Agent、Mobile-Use Agent、Mobile Creative Agent三套方案。荣耀宣布即将发布的Magic9系列将成为首批搭载QI的机型,双方合作
该研究通过对比8个开源指令模型(Llama、Gemma、Mistral、Qwen,1B-9B)在有无聊天模板下的输出,发现聊天模板如同一个开关:存在时模型更倾向使用免责声明式口吻(如“我只是一个AI”),移除后免责声明率从0.53降至0.36,体验式口吻(如“我感觉”)从0.01升至0.15。在3个模型中,研究者定位到一个可操控的激活方向,添加该方向可提升免
苹果硬件工程副总裁Tom Marieb公开表示不建议用户给iPhone贴屏幕保护膜,称团队在屏幕耐刮耐磨方面投入大量研发,希望用户直接体验原厂屏幕,此番言论引发网友热议。此外,DeepSeek将向联合国安理会介绍AI风险,月之暗面等中国企业也受邀参会;Meta个人AI助手Muse上线两周下载量超250万次,登顶美国iOS免费榜,带动Meta股价单日上涨11.
Hugging Face 用户 Youssofal 发布了 Qwen3.8-Flash-Next 的 MTPLX 量化版本 Bare Speed,基于 Qwen 125B-A6B Flash-Next 预览模型,采用统一 4-bit 量化并保留 16-bit 关键组件,通过 MTPLX 在 Apple Silicon 上实现原生多 token 预测投机解码。
开发者 abenzerps 在 Hugging Face 发布了 Qwen/Qwen-Image-2.1 的 GGUF 量化版本,提供 Q8 0 至 Q4 0 多种量化文件,并配套打包了 Qwen3VL-8B 文本编码器和 VAE,方便在 ComfyUI 中本地运行文生图。该版本不含内置安全过滤器,作者还表示正在开发完全无审查版本。
在2026杭州云栖大会上,阿里云CTO李飞飞系统阐述了Agentic Cloud战略,将Model、Harness、Context作为核心构建场景,并发布企业级Agent构建治理平台AgentCore、Agent Sandbox、新一代高性能存储CPFS等新品。阿里云重构了从AI Native Cloud、Agent Native Cloud到Context
数字营销平台Semrush数据显示,2026年8月澳大利亚零售网站整体流量下滑,阿里旗下跨境电商平台速卖通AliExpress逆势增长5.37%,访问量达1435万次,成为前20大零售网站中唯一环比增长的平台,而Amazon、Kmart、eBay、Shein均出现下滑。自2025年起,速卖通凭借Brand+品牌出海战略和海外托管本地化布局进入高速增长轨道,S
joyfox 发布了基于 Qwen3.8-27B 的未审查变体模型,通过 abliteration 技术降低拒绝率,同时保留原生架构、视觉栈和 MTP 权重。该模型在 800 个良性提示上实现 0% 拒绝率,能力得分与官方版持平,并提供多种 GGUF 量化版本。
Hugging Face 上发布了一个名为 Qwen3.8-27B RVN Heretic Abliterated Uncensored 的 GGUF 模型,它基于 Qwen3.8-27B,并在 trohrbaugh 的 ARA 消融版本上额外进行两轮全权重 ARA 处理,将有害提示拒绝率从 3/100 降至 0–1/100,同时保持极低的行为损伤(KL≈0
2026年9月17日华为全联接大会上,360集团与昇腾AI联合打造解决方案,以360智能体工厂为核心与昇腾AI深度协同,面向AI Agent场景实现全面提速。360智能体工厂支持自然语言生成智能体并组建多智能体协作蜂群,其蜂群多智能体协作技术使多角色协作任务从2小时缩短至20分钟,效率提升6倍。昇腾AI针对长序列推理和频繁KV Cache读写进行性能优化,内
东北大学 MAGICS 实验室研究 LLM 智能体在重复博弈中的行为稳定性,测试四个 7–9B 开源模型在囚徒困境、雪堆、猎鹿和和谐博弈中的表现。结果显示,智能体生成的「廉价谈话」(非约束性预沟通)在 96 个模型-博弈-情境组合中有 71 个显著提升了动作持续性,仅 5 个在社会或团队框架下出现反转。研究进一步在 Qwen 中识别出降低动作不确定性和减少轮
AgentionAI 发布 Signal 3.8 27B,这是对 Qwen3.8-27B 的微调版本,以 GGUF 格式提供,采用自蒸馏训练,不引入外部数据。官方评测显示其答案 token 减少 25%、思考 token 减少 41%,同时 GSM8K 准确率持平或提升,并借助内置 MTP 草稿头提升投机解码接受率,端到端生成时间最多缩短约 19%。
蚂蚁AI安全实验室在国家网络安全宣传周期间发布大模型内生式安全护栏SingProbe,将安全检测融入模型生成过程,让AI边生成边输出风险提示。该方案复用推理过程中的内部信息,在Ling-3.0-flash生产环境中额外开销低于0.5%,并同步发布流式安全评测基准SingStreamBench及医疗场景方案SingProbe-Med。目前SingProbe已适
Hugging Face 上发布了 GigaChat 系列的新文本嵌入模型 Giga-Embeddings-instruct-3B-0826,基于 Qwen3 架构(36 层、hidden 2048、约 3B 参数),将自注意力改为双向 encoder 风格,并用 InfoNCE 对比损失训练。模型采用 mean pooling + L2 归一化,支持俄语和