返回主题地图

DeepSeek

公司与模型 · DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与能力的搅局者

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 19:03

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 138 条。
8月3日周一 · 2 条
正文顺带提及命中实体:deepseek v3
正文顺带提及命中实体:deepseek v3
Together AI Blog一手来源观点

计算视角:AGI 可实现,硬件远未到极限

Together AI 的 Dan Fu 发表新文章,反驳 AI 发展遇到硬件瓶颈的观点。他认为当前芯片利用率极低,通过软硬件协同设计和 FP4 训练等创新可大幅提升性能。他还指出模型训练滞后于硬件发展,且现有模型已能改变复杂工作流。

8月2日周日 · 3 条
正文顺带提及命中实体:deepseek v4 pro
Together AI Blog一手来源开源

Together AI 发布开源视频翻译工具 Violin

Together AI 推出了完全开源的视频翻译工具 Violin,基于 Together API,结合语音识别、大语言模型和语音合成技术,实现高质量视频翻译。Violin 提供 Web 应用、CLI 和代理技能三种使用方式,并内置视频内容感知的聊天助手和自然语言语音选择器。该工具采用 MIT 许可证发布,旨在打破语言障碍,使视频内容更易于全球观众访问。

正文顺带提及命中实体:deepseek v4 flash 0731
Simon Willison's Weblog观点

Simon Willison 发布 2026 年 7 月通讯,涵盖多款新模型与 AI 动态

Simon Willison 发布了 2026 年 7 月的赞助者专属通讯,内容包括 OpenAI 和 Anthropic 模型的意外网络攻击、GPT-5.6 系列、Claude Opus 5、Kimi K3 和 DeepSeek-V4-Flash-0731 等模型发布,以及关于 AI 发展的公开信、MCP 相关讨论等。该通讯每月 10 美元,赞助者可提前一

正文顺带提及命中实体:deepseek
Together AI Blog一手来源商业

Together AI 完成 8 亿美元 C 轮融资,推动开源 AI 普及

Together AI 宣布完成 8 亿美元 C 轮融资,投资方包括 NVIDIA、Salesforce Ventures 等,并额外获得超过 500 兆瓦计算能力承诺。该公司提供开源 AI 全栈平台,客户包括 Cognition、Cursor 等,其平台通过优化推理栈帮助客户降低 6 至 20 倍成本。CEO 表示将继续推动开源 AI 的普及和高效推理。

8月1日周六 · 1 条
正文顺带提及命中实体:deepseek v4 flash 0731
Simon Willison's Weblog观点

开放权重革命:Simon Willison 在 Oxide and Friends 的讨论

Simon Willison 参加了 Oxide and Friends 播客,讨论开放权重模型的革命性进展,包括 Kimi K3 与专有前沿模型的竞争、网络安全事件以及关于开放权重和美国 AI 领导力的公开信。对话还涉及 Golden Gate Claude 等话题,并更新了年初的预测,新增了关于教皇对开放模型表态的预测。

7月31日周五 · 1 条
正文顺带提及命中实体:deepseek
Latent Space产品发布

OpenAI 大幅降价 GPT-5.6,智能成本四个月降 13 倍

OpenAI 宣布大幅下调 GPT-5.6 系列模型价格,其中 Luna 降价 80%,Terra 降价 20%,并推出延迟降低 2.5 倍的 Sol Fast 模式。降价得益于 GPT-5.6 的递归自我优化,包括自主内核优化、推测解码和 KV 缓存等推理加速技术,以及智能体框架的改进。相比四个月前,GPT-5.4 级别的智能成本下降了约 13 倍,年化降

7月22日周三 · 1 条
正文顺带提及命中实体:deepseek
Interconnects AI观点

开放模型综述:Kimi K3、Qwen 3.8、开源差距与蒸馏争议

在 Interconnects 播客中,Nathan Lambert 和 Florian Brand 讨论了开放模型的近期进展,包括 Kimi K3 的发布、Qwen 3.8 的开放权重计划、中国领导人的开源承诺,以及中美模型差距和蒸馏技术的争议。他们指出,开放模型在特定任务上可能接近前沿,但后训练和微调仍面临挑战。

7月20日周一 · 1 条
正文顺带提及命中实体:deepseek r1
Interconnects AI模型发布

Kimi K3开源升级:中国AI模型逼近前沿,全球生态格局生变

月之暗面于7月16日发布旗舰模型Kimi K3,这是一个2.8T参数的MoE模型,权重将于7月27日开源。K3在多个基准测试中排名前列,被认为是迄今最强的开源模型,标志着中国开源模型与前沿闭源模型的差距缩小至3-5个月。文章认为,中国AI实验室在模型构建上具备与美国顶尖实验室相当的能力,且中国高层在WAIC上承诺开源AI战略,这将对全球AI生态产生深远影响。

7月17日周五 · 1 条
正文顺带提及命中实体:deepseek
7月13日周一 · 1 条
正文顺带提及命中实体:deepseek
Interconnects AI观点

开放模型面临6个月生存危机:政策禁令风险加剧

本文警告开放权重模型面临严峻政策风险,美国白宫可能通过行政命令限制或禁止能力接近GPT-5.5、Claude Opus 4.8等前沿水平的开源模型,预计6个月内可能实施。文章指出Anthropic主导的反华模型运动实为监管捕获,其建议的禁令将摧毁美国新兴的开源模型生态。作者呼吁社区抵制此类政策,认为当前蒸馏辩论缺乏技术证据,且开放模型缺乏经济代言人。

7月11日周六 · 1 条
正文顺带提及命中实体:deepseek r1
Ollama Releases一手来源产品发布

Ollama v0.32.0 发布:新增交互式代理体验

Ollama 发布 v0.32.0 版本,引入全新的交互式代理体验,运行 ollama 命令即可启动代理,帮助用户编码和委派工作。该版本将 Codex App 集成更名为 ChatGPT,并简化了集成选择菜单,仅保留最受欢迎的集成。此外,对于较旧的代理模型(如 CodeLlama、Qwen2.5、Llama 3.x 等),启动前会显示弃用警告。

6月29日周一 · 1 条
正文顺带提及命中实体:deepseek
Interconnects AI研究

开源生态多元化:Zyphra、Cohere、Poolside 等推动模型发布新趋势

Interconnects AI 的最新开源模型报告指出,开源生态系统正变得更加多元化,参与者包括纯模型制造商、大科技公司和产品公司。报告重点推荐了 NVIDIA 的 Nemotron 系列、Cohere 的 Command A+、GLM-5.2、Zyphra 的 ZAYA1 和 Poolside 的 Laguna-M.1 等模型,并讨论了开源模型发布的动机

6月22日周一 · 1 条
正文顺带提及命中实体:deepseek r1
Interconnects AI模型发布

GLM-5.2:开源代理模型的重大突破

Z.ai 于 2026 年 6 月发布了开源模型 GLM-5.2,该模型在编码代理任务中表现出色,被社区视为开源代理的转折点。其性能在多个基准测试中与 OpenAI 和 Anthropic 的闭源模型相当,甚至超越,引发了广泛关注。作者认为 GLM-5.2 缩小了开源与闭源模型的能力差距,并可能对 Anthropic 等闭源实验室构成竞争压力。

5月15日周五 · 1 条
正文顺带提及命中实体:deepseek r1
vLLM Releases一手来源产品发布

vLLM v0.21.0 发布:弃用 transformers v4,新增多项性能优化

vLLM 发布 v0.21.0 版本,包含 367 个提交,来自 202 位贡献者。该版本正式弃用 transformers v4,要求 C++20 编译器,并引入 KV 卸载与混合内存分配器集成、推理预算感知的投机解码、Blackwell 上的 TOKENSPEED MLA 后端等新特性。同时新增多种模型架构支持,并在性能、硬件支持(如 AMD ROCm、

3月22日周日 · 1 条
正文顺带提及命中实体:deepseek v4
Ahead of AI教程

现代 LLM 注意力变体视觉指南

Sebastian Raschka 发布了一篇关于现代 LLM 中注意力机制变体的视觉指南,涵盖 MHA、GQA、MLA、稀疏注意力和混合架构等。他同时推出了包含 45 个条目的 LLM 架构画廊,并提供海报版本。文章旨在作为参考和学习资源,帮助读者理解不同注意力变体的原理和应用。

2月25日周三 · 1 条
正文顺带提及命中实体:deepseek
Ahead of AI研究

2026年初开源LLM架构综述:十大模型对比

本文回顾了2026年1月至2月期间发布的10个开源权重LLM,重点比较了它们的架构异同。主要发布包括Arcee AI的Trinity Large、Moonshot AI的Kimi K2.5、StepFun Step 3.5 Flash、Qwen3-Coder-Next、z.AI的GLM-5、MiniMax M2.5、Nanbeige 4.1 3B、Qwen

4月14日周一 · 1 条
正文顺带提及命中实体:deepseek r1
GLM New Releases一手来源模型发布

智谱AI发布5款新模型:GLM-4-Air和GLM-Z1系列

智谱AI于2025年4月14日发布多个新模型,包括两个基座模型GLM-4-Air-250414和GLM-4-Flash-250414,以及三个推理模型GLM-Z1-AirX、GLM-Z1-Air和GLM-Z1-Flash。其中GLM-4-Air性能比肩GPT-4o和DeepSeek-V3-0324,GLM-Z1-AirX速度最快可达200 tokens/秒,