智象未来发布HD-V1全模态视频模型并获C+轮国资融资

合肥企业智象未来发布HD-V1,原生全模态视频模型一次生成5到20秒1080p

9月15日,总部位于合肥的智象未来(HiDream.ai)发布首个原生全模态视频生成模型HiDream-O1-Video-1.0(简称HD-V1),同步宣布完成C+轮融资,投资方为新微资本、交子资本、工银资本三家国资背景产业资本。HD-V1采用自研Unified Transformer原生全模态架构,支持文本、图片、视频多模态输入,可一键直出5至20秒1080p视频,并能自动"读懂"模糊、口语化的表达意图,音画同步生成而非后期拼接配音。

双榜高位:图生视频全球第四、盲测第八

据公司披露,截至2026年9月,HD-V1在Artificial Analysis图生视频榜单排名全球第四,在Arena.ai盲测平台位列第八。Artificial Analysis的图生视频榜以标准化、可复现的基准评测全球头部模型,被视为衡量AI视频实力的重要标尺。HD-V1能进入第一梯队,意味着中国视频大模型在"理解意图"和"物理规律建模"两个维度拿到了国际认可——它生成前先对用户输入做结构化规划,把重力、碰撞、惯性写进底层逻辑,而非让画面"动得顺"就完事。

技术路线:前置意图理解加物理规律建模

智象未来CTO姚霆把核心突破概括为两点:模型在生成视频前先做"前置意图理解"和"物理规律建模",规划镜头时长、场景构图、运镜焦段和音效设计。传统模型常出现物体穿模、光影违和,HD-V1把物理约束作为生成逻辑的一部分,使运动与光影更贴近现实。创始人梅涛强调,公司要做的是"一个原生全模态底座、四大模型同源演进"的体系,覆盖图像、视频、3D交互和具身动作,而不是四条互不相干的平行线。

融资节奏密集,四个月三连融、估值破10亿美元

智象未来的融资节奏相当密集。2026年4月至7月,公司三个月内连续完成三轮融资,累计超21亿元,投后估值突破10亿美元跻身独角兽;7月完成的15亿元C轮由社保基金四川振兴科创基金、工银资本等联合领投,华策影视、上影新视野基金等影视产业资本跟投。9月15日C+轮再引入国资产业资本,资金指向明确:继续夯实原生全模态底座,把视频模型补齐进模型矩阵的关键一环。

对短剧漫剧生产的价值

对短剧、漫剧创作者而言,HD-V1这类"听得懂、演得连贯"的模型,价值在于降低工业级成片的门槛。音画一体生成省掉后期配音环节,物理规律建模减少穿模穿帮,意图理解让"口语化导演指令"能直接落地。当国产视频模型在榜单上站稳第一梯队,内容公司不必再依赖海外工具,本土化的工作流和资产库会成为新的竞争力。智象未来从合肥出发,拼的是底座而非单点效果。

THE END
责任编辑:飞天影视
免责声明:本站所使用的字体和图片文字等素材部分来源于互联网共享平台。如使用任何字体和图片文字有冒犯其版权所有方的,皆为无意。如您是字体厂商、图片文字厂商等版权方,且不允许本站使用您的字体和图片文字等素材,请联系我们,本站核实后将立即删除!任何版权方从未通知联系本站管理者停止使用,并索要赔偿或上诉法院的,均视为新型网络碰瓷及敲诈勒索,将不予任何的法律和经济赔偿!敬请谅解!

栏目精选