近日,在奇绩创坛路演日上,极 佳科技联合清华大学自动化系正式发布中国*超长时长、高性价比、端侧可用的Sora级视频生成大模型「视界一粟 YiSu」,引起社会各界广泛的反响和关注。
「视界一粟 YiSu」拥有模型原生的16秒超长时长,并可生成至1分钟以上;同时还拥有超大运动、*表现力、懂物理世界等众多优势;更重要的是,YiSu模型成本更低、速度更快、端侧可用;希望通过YiSu模型强大的性能和性价比,更快实现长视频生成的大规模产品应用。
01 不止步于Sora的DiT架构,融合LLM和扩散模型的新一代自研架构,打造视频生成的*方案。
年初Sora的爆火,让DiT受到了业内极大的关注,很多公司和项目也开始复现DiT路线。极 佳科技和清华大学研究人员在视频生成技术路线上有着深入的积累和独特的理解,在autoregressive、Masked Token、DiT、UNet等不同路线方面均拥有丰富的经验。此前,团队提出WorldDreamer,是全球*次以Transformer和LLM(Masked Token路线)为中心的视频生成工作。
「视界一粟 YiSu」基于团队自研的视频生成大模型技术,并没有止步于DiT,而是融合LLM和扩散模型的自研架构,结合各种路线的优势,在多模态融合、训练效率、推理效率、模型效果等方面达到优化,打造视频生成的*方案。
02 不止步于视频生成,同时走向世界模型,加速走向物理世界通用智能。
视频生成不是终点,极 佳科技认为更重要的目标是走向世界模型。世界模型对于自动驾驶、通用机器人等物理世界的通用智能至关重要,在数据生成、闭环仿真、端到端方案等方面都拥有关键的作用。而目前我们看到,视频生成是走向世界模型最高效的路径。
在世界模型方向,极 佳科技发布了中国*自动驾驶世界模型,并获得了业内*世界模型商业化定点和落地,签约多个头部主机厂和大客户;极 佳科技通过世界模型已经服务自动驾驶、机器人等具身智能客户几十余家,携手行业加速走向物理世界通用智能。
03 YiSu大模型正在飞速进化,欢迎携手YiSu,共同探索视界。
此次发布的是YiSu-Beta V0.5版本,YiSu大模型正在按照每周一个小版本、每月一个大版本的迭代速度飞速成长和进化,未来几个月在视频时长、可控性、推理速度、运行成本、理解物理世界等方面将持续迎来大幅度的提升,为行业客户和广大用户带来更多的价值和功能。
极 佳科技核心团队是兼具技术、产业、创业的*综合团队;拥有超过十年、全球*的AI技术积累,来自清华大学、中科院、中科大等知名院校,累积发表AI*论文200余篇,多次获得全球权威AI比赛世界冠军,发布多个世界影响力的AI技术成果;也拥有丰富的产业经验,来自微软、阿里、地平线等知名企业,拥有丰富的AI大规模产业落地经验,负责多个数亿级项目量产;同时还拥有AI、自动驾驶、大模型等方向连续创业经验。「视界一粟 YiSu」视频大模型由极 佳科技和清华大学自动化系研究人员联合研发,受到北京市科委“中央引导地方”人工智能专项项目支持。