哎呀好网企业服务网
返回AI大全导航
V

Vidu

通用大模型已备案
备案单位北京生数科技有限公司
所属地区北京市
备案时间2024-11-25
备案编号Beijing-Vidu-20241125S0003

AI介绍

在生成式AI技术加速渗透内容创作领域、产业对高效高质AI生成工具需求持续攀升的行业背景下,由北京生数科技有限公司开发的Vidu生成式AI产品正式完成备案,备案编号为Beijing-Vidu-20241125S0003,备案时间2024年11月25日,成为国内合规AI生成赛道中面向专业创作者与大众用户的核心产品之一。

作为国内原生的生成式AI内容创作工具,Vidu依托生数科技在多模态大模型领域的技术积累,定位于打通文本、图像、视频生成链路的一站式创作平台,既能够满足普通用户轻量化内容生成需求,也可以支撑专业创作团队的高标准产出要求,面向不同层级用户开放适配性创作能力。

Vidu的核心功能覆盖多模态内容生成全场景,具体包含四大板块:第一是文生图、图生图的高精度图像生成,支持用户输入文本描述生成从商业海报到艺术插画的各类视觉内容,也可基于上传的参考图实现风格迁移、细节修改、构图重构等操作,最高支持生成8K分辨率的高清成品;第二是文本驱动的动态视频生成,支持用户输入百字以内脚本或上传静态参考图生成最长2分钟的连贯高清视频,可自动适配镜头运动、光影过渡逻辑,解决了传统AI视频生成易出现画面闪烁、结构扭曲的痛点;第三是AI辅助创意延展功能,可基于用户给出的模糊创意方向,自动生成多套内容方案、配色参考与排版建议,降低创作入门门槛;第四是商业版权合规保障,Vidu内置自研版权检索模块,生成内容可一键出具合规授权说明,为商业用途内容输出提供版权保障。

技术层面,Vidu依托生数科技自研的Vidu-1.5多模态大模型构建底层能力,具备三大突出技术特点:首先是采用了改进型扩散Transformer架构,在保证生成质量的同时,将推理速度较同参数规模模型提升了40%,大幅降低用户等待时长;其次是训练阶段融入了百万级合规创作数据集微调,对中文场景下的创意描述理解精度更高,能够精准识别国风元素、中文排版等本土化需求;最后是支持用户自定义生成规则,可通过嵌入LoRA权重实现品牌风格、特定人物的一致性生成,满足批量商业创作的一致性要求。

当前Vidu已经覆盖多个核心应用场景:在商业内容领域,可为电商平台商家快速生成商品主图、详情页海报、直播背景,帮助中小商家降低视觉制作成本;在内容创作领域,自媒体创作者可利用Vidu快速生成短视频素材、封面图、剧情分镜,提升内容产出效率;在文创设计领域,设计师可借助Vidu快速产出多个创意草案,缩短前期创意 brainstorm的周期;在个人用户场景,普通人也可通过简单的文字描述生成个人艺术照、定制壁纸、手账素材等个性化内容,降低AI创作的使用门槛。

作为2024年底刚完成备案的合规生成式AI产品,Vidu后续还将持续优化长视频生成、多场景一致性生成等能力,为国内内容创作产业的AI化转型提供稳定可靠的工具支撑。