新一代智象原生全模态世界模型架构在合肥发布

大皖新闻讯 4月26日下午,在合肥举行的第四届科交会上,全球领先的大模型技术创新公司、合肥高新区企业智象未来发布了“新一代原生全模态世界模型架构及图像大模型”hidream-o1-image。

加拿大工程院外籍院士、智象未来创始人兼ceo梅涛博士表示,下一代大模型竞争的关键,不在于单一模态能力的叠加,从多模态走向全模态,以原生统一架构对真实物理世界进行原生、全模态的统一建模,围绕真实世界的表达、理解与生成,是新一代大模型技术的关键。

智象未来创始人兼ceo梅涛博士

全模态世界模型hidream-o1发布

当天上,智象新一代全模态模型架构hidream-o1和图像大模型hidream-o1-image首次亮相。

其中,hidream-o1-image采用全球领先的原生全模态架构transformer(uit),闭源版本参数达到千亿级别,在六个业界标准benchmark 达到sota,超过了google 的nano banana 2、gpt image 1 和 seedream 4.0,处于全球领先水平。同时,智象也发布了一个8b参数量的开源版本,该开源模型在6项基准测试中达到与flux.2、qwen-image同量级甚至略优的水平,并适配本地部署和低代码智能体调用场景。

智象未来联合创始人兼cto姚霆博士表示:“图像是世界建模的空间基底,定格了现实世界瞬时时刻的完整状态信息。因此,图像并非独立于视频之外的单点能力,而是视频生成乃至通向原生全模态世界模型的关键入口。在uit原生统一架构下,图像与视频训练能够协同进行、相互增强,从而为模型进一步走向全模态奠定基础。”

据了解,智象持续专注底层模型架构创新,本次采用全球首创uit架构发布的hidream-o1,再次证明了智象在底层大模型发展上的全球领先水平。

智象未来联合创始人兼cto姚霆博士介绍新一代原生全模态世界模型

三大新品引领agentic时代

科交会上,智象未来专为专业影视创作团队推出的全球首个ai影视创作智能体“帧赞”、为平台商家打造的商业营销智能体“hiburst”和为opc打造的社媒内容创作智能体“vivago”等aigc新品也悉数亮相。

其中,专业级ai影视创作协作智能体“帧赞”1.0,依托自研大模型,“帧赞”以电影级画质生成能力和“创意—分镜—成片”全流程打通的核心实力,为创作团队提供了集多角色协作、高效化生产、精细化管理于一体的高品质ai内容生产引擎,兼顾品质与效率。

在aigc商业营销智能体方面,智象未来正式推出ai营销视频生产平台hiburst1.0,为平台跨境电商打造ai视频批量生成工具,针对卖家视频制作慢、成本高、转化率低等痛点,通过ai技术与团队协作模式,大幅降低制作成本并提升效率,从而提升跨境营销数字化水平,助力中国品牌高效出海。

在aigc社媒创作智能体方面,智象未来推出了具有一站式ai agent创作能力的opc创作工具vivago3.0。其中,vivago3.0面向专业创作者,具备端到端的短视频及营销内容创作与编辑修改能力。通过自研3d video模型与推理加速技术,vivago将特效生成从分钟级提速至秒级,提升创作效率与体验。

达成多项战略合作 加速产业化落地

在本次科交会中,智象未来还与多家行业领先企业达成战略合作,共同推动原生全模态大模型在少儿动漫、跨境电商、产业投资、文创ip等多个赛道的产业化落地,各方将围绕模型能力调用、智能体应用开发、行业场景共建等方向开展深度合作。

未来,智象未来将持续深耕全模态大模型技术底座,深化商业化场景落地与生态协同,致力于成为世界模型领域的全球领先企业。

大皖新闻记者 项磊

编辑 崔恒

↑