返回主题地图

AI 视频

技术方向 · AI 视频生成与理解:文生视频模型、视频编辑工具与影视创作 · 共 8

8月12日星期三 · 1
NVIDIA Technical Blog一手来源产品发布37

NVIDIA JetPack 7.2.1 新增 Agentic 视频技能与 PyNvVideoCodec 支持

NVIDIA 发布 JetPack 7.2.1,首次在 Jetson 平台支持 PyNvVideoCodec 2.2,提供硬件加速视频编解码的 Python 接口,并引入基于 agent 的视频技能,帮助开发者自动配置、验证和基准测试编解码流程。该版本旨在加速 Jetson 上的 AI 应用开发,提升视频处理管线的效率和可复现性。

8月11日星期二 · 2
Vercel AI SDK Releases一手来源产品发布21

Vercel AI SDK v6.0.248 发布:视频生成支持自适应宽高比

Vercel AI SDK 发布 v6.0.248 版本,主要更新为视频生成功能:在 generateVideo 和 VideoModelV3CallOptions 中支持 aspectRatio: 'adaptive',允许视频模型根据输入自动推导输出比例,特别适配 BytePlus Seedance 2.5 模型。该更新避免了显式宽高比时的类型断言,但支

arXiv cs.IR一手来源研究10

视觉世界搜索:持久视觉记忆、分层索引与源证据

本文提出了一种面向持续视觉数据流的搜索基础设施模型,包括分析器定义的场景、持久理解工件、视觉记忆和分层索引。作者开发了VideoDB数据格式(VDB)并在生产中实现,通过类型化搜索界面支持规划检索、状态调查、直接访问和基于证据的综合。在四个公共数据集上的9800多个查询对比中,通用组件流水线在Recall@1/@3/@10上优于商业视频原生引擎,表明视觉世界

8月8日星期六 · 1
Vercel AI SDK Releases一手来源产品发布1

Vercel AI SDK 7.0.58 发布:新增自适应视频宽高比支持

Vercel AI SDK 发布 ai@7.0.58 版本,主要更新包括:尊重代理设置中的 ToolLoopAgent 超时;为 generateVideo 添加 'adaptive' 宽高比支持,适配 BytePlus Seedance 2.5 等模型;通过使 Zod v4 导入可树摇动来减小包体积。

8月6日星期四 · 1
雷峰网 AI科技评论产品发布0

金刚GC3芯片发布:RISC-V数据流架构重新定义视频AI算力

在CCF Chip 2026大会上,中科通量发布了全球首款RISC-V数据流架构视频智能AIGC芯片金刚GC3,该芯片采用12核设计,支持128路1080P硬解码,INT8算力达200 TOPS。金刚GC3通过数据流架构优化视频处理效率,旨在解决通用芯片在视频AI场景下的能耗和延迟问题,标志着国产RISC-V高端算力在视频专用领域的商业化提速。

8月5日星期三 · 1
Hugging Face New and Trending Models一手来源模型发布0

MiniMax-H3 GGUF 量化版发布,支持文本生成视频

realrebelai 在 Hugging Face 上发布了 MiniMax-H3 模型的 GGUF 量化版本,支持文本到视频生成,并提供了 ComfyUI 的目录结构。该模型基于 Comfy-Org/MiniMax-H3,包含 UNet、文本编码器和 VAE 组件,用户需从 Comfy-Org 获取 VAE 文件。发布者声称已获得 MiniMax 的许可

8月2日星期日 · 2
The Verge AI商业0

Pippa以收入分成吸引艺术家,但伦理AI之路仍艰难

AI视频生成初创公司Pippa推出收入分成模式,每次用户生成基于艺术家风格的内容,艺术家即可获得报酬,试图以更道德的方式吸引艺术家。然而,其技术仍基于未经明确同意抓取的网络数据训练的开源模型,且目前仅有4位签约艺术家和约800名订阅用户。联合创始人认为这能改变AI行业的'血腥历史',但面临艺术家社区的质疑和竞争压力。

xAI News一手来源产品发布0

xAI 发布 Imagine Video 1.5 更新,支持图像语音参考和1080p

xAI 发布了 Imagine Video 1.5 的更新版本,新增了图像和语音参考功能,支持文本、图像和语音生成视频,并原生支持 1080p 分辨率。该功能在美国率先面向 SuperGrok Heavy 和 SuperGrok Plus 用户推出,随后将向所有用户开放。同时,xAI API 也已支持图像参考、文本转视频和原生 1080p,语音参考需申请。