返回主题地图

AI 编码

技术方向 · AI 写代码的一切:编码助手、Vibe Coding、代码模型与开发工作流 · 共 214 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

4月24日周五 · 1 条
正文结构化主题已通过公开置信门槛
One Useful Thing观点

GPT-5.5体验:AI能力持续跃升,但前沿仍不均衡

作者Ethan Mollick提前体验了GPT-5.5,认为其性能显著提升,尤其在编码和图像生成方面,并展示了模型、应用和工具链的进步。他用GPT-5.5 Codex处理自己的学术数据,生成了接近博士二年级水平的论文,表明AI能力仍在快速提升,但前沿能力仍不均衡。

4月16日周四 · 1 条
正文结构化主题已通过公开置信门槛
Claude App Release Notes一手来源模型发布

Anthropic 发布 Claude Opus 4.7,增强编码与视觉能力

Anthropic 发布了其最新模型 Claude Opus 4.7,现已全面可用。该模型在软件工程和复杂、长期运行的编码任务上有所改进,并提升了视觉能力,支持更高分辨率的图像识别。

4月7日周二 · 1 条
正文结构化主题已通过公开置信门槛
GLM New Releases一手来源模型发布

智谱发布GLM-5.1旗舰模型,长程任务能力显著提升

智谱AI发布了新一代旗舰模型GLM-5.1,其编码能力和长程任务处理能力显著增强,可独立持续工作长达8小时,实现从规划到交付的完整闭环。该模型综合能力全面对齐Claude Opus 4.6,成为首个在综合能力上对齐该模型的中国模型,并跻身全球开源模型前列。通过multi-turn SFT、RL与过程质量评估体系,GLM-5.1在长任务中的稳定性、一致性与工具

4月4日周六 · 1 条
正文结构化主题已通过公开置信门槛
Ahead of AI观点

编码代理的组件:工具、内存与仓库上下文如何提升 LLM 实践

本文由 Ahead of AI 发布,作者 Sebastian Raschka 探讨了编码代理(coding agents)的设计与组件,强调代理系统(如 Claude Code、Codex CLI)通过工具使用、内存和仓库上下文管理,使 LLM 在实际编码任务中表现更佳。文章区分了 LLM、推理模型、代理和代理框架(harness)的概念,并指出编码框架(

4月2日周四 · 1 条
正文结构化主题已通过公开置信门槛
GLM New Releases一手来源模型发布

智谱AI发布GLM-5V-Turbo多模态Coding基座模型

智谱AI于2026年4月2日上线了GLM-5V-Turbo多模态Coding基座模型,该模型在更小参数量下实现更优性能,增强了细粒度理解、几何感知与空间理解能力,并强化了GUI Agent和Coding Agent等复杂任务表现,同时扩展了多模态工具链,支持画框、截图、读网页等工具。

2月17日周二 · 1 条
正文结构化主题已通过公开置信门槛
Claude App Release Notes一手来源模型发布

Anthropic 发布 Claude Sonnet 4.6,支持百万级上下文

Anthropic 发布了 Claude Sonnet 4.6,这是其最强大的 Sonnet 系列模型,在编码、计算机使用、长上下文推理、智能体规划、知识工作和设计方面均有全面升级。该模型在测试版中提供 1M token 的上下文窗口。Anthropic 通过博客文章详细介绍了该模型的发布。

2月12日周四 · 1 条
正文结构化主题已通过公开置信门槛
GLM New Releases一手来源模型发布

智谱发布GLM-5旗舰模型,集成DeepSeek稀疏注意力

智谱AI于2026年2月12日发布新一代旗舰模型GLM-5,专为复杂系统工程与长程Agent任务设计,实现从代码到工程的范式跃迁。该模型在后端架构设计、复杂算法实现及顽固Bug修复上展现出卓越的深度推理能力,在代码逻辑密度和系统工程能力上对标Claude Opus 4.5。GLM-5首次集成DeepSeek Sparse Attention,在保持长文本效果

2月5日周四 · 1 条
正文结构化主题已通过公开置信门槛
Claude App Release Notes一手来源产品发布

Claude 发布 Opus 4.6 并推出 PowerPoint 插件

Claude 发布了其最智能模型 Opus 4.6,提升了编码能力。同时推出了 PowerPoint 插件,并更新了 Excel 插件,使其基于 Opus 4.6 并支持原生 Excel 操作如数据透视表编辑和条件格式。

12月22日周一 · 1 条
正文结构化主题已通过公开置信门槛
GLM New Releases一手来源模型发布

智谱AI发布GLM-4.7基座模型,编码与Agent能力全面升级

智谱AI于2025年12月22日上线了GLM-4.7基座模型,该模型在编码能力、Agentic Coding、前端与视觉代码理解以及通用对话方面均有显著提升,旨在提高代码生成质量和端到端开发效率。

11月19日周三 · 2 条
正文结构化主题已通过公开置信门槛
Google DeepMind News一手来源模型发布

Google 发布 Gemini 3 模型,强化代理式编码与多模态能力

Google DeepMind 发布了 Gemini 3 系列模型,其中 Gemini 3 Pro 在推理、编码和多模态理解上超越前代,并在 Terminal-Bench 2.0 等基准上取得领先成绩。该模型通过 Gemini API 提供预览,定价为每百万输入 token 2 美元、输出 token 12 美元,并集成于 Google Antigravit

正文结构化主题已通过公开置信门槛
Google DeepMind News一手来源产品发布

Google 推出 Antigravity:智能体优先的开发平台

Google DeepMind 发布了新的智能体开发平台 Google Antigravity,该平台基于 Gemini 3 模型,提供 AI 驱动的 IDE 体验,并引入浏览器控制、异步交互和智能体优先的产品形态。Antigravity 强调信任、自主、反馈和自我改进四大原则,旨在让智能体自主规划和执行复杂的端到端软件任务。目前该平台已免费公开预览,并附带

10月31日周五 · 1 条
正文结构化主题已通过公开置信门槛
Kimi Model Repository Activity一手来源模型发布

Moonshot AI 发布 Kimi K2:万亿参数开源智能体模型

Moonshot AI 发布了 Kimi K2,这是一个具有 1 万亿总参数和 320 亿激活参数的混合专家(MoE)语言模型,专注于智能体能力。该模型在多个基准测试中表现出色,尤其在编码任务上,并提供了基础版和指令版两种变体。Kimi K2 采用 Muon 优化器进行训练,支持 128K 上下文长度,并已在 Hugging Face 上开源。

10月15日周三 · 1 条
正文结构化主题已通过公开置信门槛
Claude App Release Notes一手来源模型发布

Anthropic 发布 Claude Haiku 4.5 并更新 Chrome 扩展

Anthropic 发布了其最快、最具成本效益的模型 Claude Haiku 4.5,该模型在编码、计算机使用和代理任务上匹配 Sonnet 4 的性能。Claude 在 Chrome 中的扩展现在默认使用 Haiku 4.5,以提供更快的响应,并新增了图像上传和屏幕高亮功能。

9月29日周一 · 1 条
正文结构化主题已通过公开置信门槛
Claude App Release Notes一手来源模型发布

Anthropic 发布 Claude Sonnet 4.5 并更新 Chrome 扩展

Anthropic 发布了新模型 Claude Sonnet 4.5,号称在真实世界代理、编程和计算机使用方面表现最佳。Pro 用户现在可以使用 Claude 的文件创建和编辑功能,移动端所有付费用户也可使用。Claude in Chrome 更新,由 Sonnet 4.5 驱动,支持多标签页操作、理解常用网站、通知和图像上传。