AI

智象发布首款物理规律导向视频模型

2026年9月15日,智象未来正式发布首个原生全模态视频生成模型HiDream-O1-Video-1.0(简称HD-V1)。该模型采用自研原生全模态架构,支持文本、图片、视频等多模态输入,能够一键生成5至20秒的1080p高保真视频,并在意图理解、物理规律理解、自主规划叙事及音画一体化生成等方面实现全面升级。

来源:36氪

智象发布首款物理规律导向视频模型

2026年9月15日,智象未来(HiDream.ai)正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0(模型简称 HD-V1)。此次发布标志着智象未来在视频生成领域的重要技术突破,特别是在物理规律导向方面取得了显著进展。

核心架构与技术特点

HD-V1 采用了智象自研的原生全模态架构,这一架构设计旨在打破传统单一模态输入的局限,实现更高效、更自然的多模态内容生成。

1. 多模态输入支持

模型支持文本、图片、视频等多种模态输入。这意味着用户可以通过不同的方式向模型传达创作意图,系统能够精准理解并融合这些多源信息,从而生成符合预期的视频内容。

2. 高保真视频直出

在输出质量与效率方面,HD-V1 能够一键直出 5–20 秒的 1080p 高保真视频。这一能力大幅降低了高质量视频内容的制作门槛,提升了内容创作的效率。

3. 全面能力升级

除了基础的视频生成能力,HD-V1 在多个核心维度均实现了全面升级:
- 意图理解:能够更精准地捕捉和理解用户的深层创作意图。
- 物理规律理解:作为首款物理规律导向的视频模型,HD-V1 在生成视频时能够更好地遵循现实世界的物理规律,减少画面穿模、重力异常等不合理现象,提升视频的真实感。
- 自主规划叙事:模型具备一定的自主叙事能力,能够根据输入内容自动规划视频的情节发展和镜头语言。
- 音画一体化生成:支持画面与声音的同步生成,确保音画高度契合,提供更具沉浸感的视听体验。

行业意义

HiDream-O1-Video-1.0 的发布,为多模态内容创作提供了强大的技术支撑。其强调的物理规律导向,有望解决当前视频生成模型中普遍存在的物理常识缺失痛点,推动 AI 视频生成技术向更实用、更真实的方向发展。

原始来源: 36氪

本文由博一・AI营销中枢整理编辑,用于行业观察分享。观点归原作者所有。

更多「AI」资讯

让品牌在 AI 中生长

免费诊断你的品牌 AI 可见度