跳到主要内容

AI教母李飞飞新模型 一键生成3D电影效果

46 0
AI摘要

李飞飞创办的World Labs发布全球首个多模态世界模型Atlas,能以像素级精确控制生成图像视频,并在三维空间中完美重建。该模型能接受多模态输入,生成立体视图,实现“子弹时间”效果,并超越现有开源重建模型。Atlas通过指定摄像机位置和角度生成匹配图像,填补细节,胜任世界生成、重建和模拟任务,输出长达1分钟的1440p高清视频。

AI教母再出大招

率先正式发布全球首个多模态世界模型Atlas的World Labs由李飞飞创办而成这个情况, 这款所涉及的模型达成了像素级别的精确相机控制这个成果, 它出现能够生成高质量图像以及视频帧的现实实例, 并且它在三维空间里达成了完美重建这种表现。

Atlas作为全新模型, 是从头开始预训练的, 它能够无缝接受多模态输入, 这其中包括相机移动, 它会把这些输入转化为立体的三维视图, 而这一突破给视觉生成领域带来了革命性变化。

像素级相机控制

Atlas极具关键意义的突破关键点在于其具备像素级精准度的相机控制技术, 用户能够凭借指定任意的摄像机位置以及角度, 进而生成与原始内容几何形状达成完美匹配效果的参考图像。

此项技术具备以平滑方式扩充画面的能力, 且能够凭借自身想象去填充输入内容里未呈现的场景细节。用户只要通过简单的操作, 便能够收获如同好莱坞大片那样的“子弹时间”拍摄效果。

三维重建能力

AI教母李飞飞新模型 一键生成3D电影效果

单张或多张输入图像里, Atlas能输出明确的三维模型, 于重建效果层面, 它已超越当下诸多顶级开源重建模型的表现。

官方给出的数据表明, 这个模型能够在数十张输入的图像里, 将真实的场景给重建出来, 与此同时, 它还支持从新颖的视角去生成图像的帧, 也能有显式的三维输出, 其适用的范围是非常广泛的。

多样化应用场景

具备全面胜任之类任务生成能力的Atlas, 有着世界重建以及模拟等方面的本事。它能够输出时长最长一分钟的1440p高清视频, 以此满足专业化等级的视觉创作各种需求。

该模型具备对时空模拟功能的支持, 借助输入视频展开空间以及时间的建模操作, 对视频予以重新构图, 以此强化戏剧性的视觉效果, 为机器人从真实迈向模拟的工作流程给予技术方面的支撑。

文本生成与全景渲染

对从文本生成图像以及360度全景视图, 该模型是全面予以支持。它可以精确地跟随着复杂的提示词, 去渲染文字所包含的内容, 并且展现出各种各样不同的视觉风格呢。

这样一种特性致使Atlas不但适用于专业的影视制作领域, 而且还为普通的创作者供给了便捷的工具。用户能够凭借简单的描述, 迅速获取高质量的视觉内容。

合作与开放计划

当下, World Labs已然给予了一部分合作伙伴获取Atlas模型抢先体验资格的机会, 并将在接下来不太短的几周时间里, 朝着范围更为广泛的早期访问者循序渐进地逐步放开使用权限。

这一采取的开放策略, 有着利于吸引更多开发者投身参与测试以及进行优化的作用, 能够加快多模态世界模型技术朝着商业化进程发展的速度, 促使其在市场应用方面得以落地。

按照你的考量, Atlas模型给影视制作以及内容创作行业带来的变革会是如何的, 会在怎样的程度上产生影响呢, 期待在这个评论域里面能将你的见解分享出去。

登录后参与评论

评论仅开放给已登录并完成邮箱绑定的用户。

评论 0

暂无评论。