Token导航 LogoToken导航TokenDH.com

我用AI生成了一个世界,小白也能玩

更新时间 2026-05-16来源 AI设计小华正文 2673字阅读约 9分钟22 张图片

最近才发现这个有意思的东西,分享给大家玩玩~

前段时间,李飞飞的空间智能独角兽World Labs,放出了两款新的世界模型——Marble 1.1和Marble 1.1-Plus。

图片

玩的地方给大家准备好了,

老朋友TapNow也对接了Marble 1.1和Marble 1.1-Plus,

最早将world model转为可编辑。

👇🏻链接:

    https://app.tapnow.ai/?tap_referral=aisjxh_gzh_20260508
    图片

    玩之前跟大家说一下,什么是世界模型呢?

    先说一个你可能熟悉的场景,

    你有没有用过那种全屋设计软件?把房间的尺寸输进去,它给你渲染出一个可以走进去的3D空间,你可以在里面转悠,换沙发换墙色,看效果。

    世界模型干的事情跟这个有点像,但门槛低得离谱。

    说到这儿,就让我想到《刀剑神域》、《头号玩家》,

    如果在自己创世的空间,很多人在这个空间里面进行共创发展出了很牛逼的虚拟世界,而你可以对这个空间随时编码任何的东西。

    说到这一点我就很激动了,如果G-2模型和世界模型结合使用,那可玩性不就逆天了......

    话不多说,直接开始看看别人的实测,然后自己亲测一波~

    01别人怎么玩

    这个哥们直接做了一个画中画的效果,
    图片
    他没有去扫描什么现实空间,而是直接生成了一个画中画——3D世界里面套着另一个3D世界。
    多间工作室连成一片,镜头穿过一扇门,又是另一个空间,再穿过去,还有一个......

    还有人拿了一张博物馆的照片,就一张普通的照片,生成了一个可以在里面漫游的数字展馆。

    图片
    镜头往前推的时候,我脑子里冒出一个词——Sketchup建完模、渲染器跑完直接推镜头,就是那个感觉。

    但那个是要建模师花好几天的活,这个,一张照片,几分钟。

    以前的全景图,你对着一张球形图呆呆地用鼠标拖来拖去,拖一下动一下,没有任何空间感。

    现在这个东西给你的是真实的纵深感,你是在"走进去",不是在"看着它转"。

    02案例实测

    我自己也玩一把,先拿刀剑神域试一试,

    我想知道它对虚拟场景的还原能力到底有多强

    因为拍几张照片,就还原出的3D世界,对于现实的全景图来说,也能生成的很棒,然后导入全景图喂给AI,它能理解的更多,出的效果更好。

    但游戏截图里的光影、材质、空间结构,得全靠模型自己去理解和延展。

    在TapNow的画布里生成一张刀剑神域游戏操作页面,

    在图片右侧拉出3D世界节点,
    图片

    多人同时编辑同一个3D世界时,版本切换、场景编辑或重新生成可能互相覆盖,

    所以建议一次只由一人编辑同一个3D世界。

    使用360等全景图时,需要选择全景图输入,3D世界会以全景图内容为主要依据生成。

    图片

    这里咱使用的是1张刀剑神域游戏操作页面的图,直接选择普通照片即可,模型选择Marble 1.1,

    图片

    提示词:根据这一张图,给我延展出周围的游戏3D世界

    小等7-8min,一个全景自由视角,操作度拉满的3D世界跑出来了,

    图片

    进入3D世界,

    图片

    我直接一次性直出没有猛抽的情况下,环顾四周,整个交互页面流畅度很好。

    画面呈现的分辨率色彩也很高清,并没有为了提升动效而去牺牲画质本身。

    转到旁边,用鼠标自由的选取一块地方,打开编辑器,直接输入在这个位置给我增加一个垃圾桶。

    图片

    除此之外也可以在垃圾桶旁边增加一把长椅,只要你想,直接点石成金。

    接下来换Marble 1.1-Plus试了一把。

    等待时间稍微长了几分钟,因为它生成的地图更大。

    图片

    puls版本会等得稍微久几分钟,因为它生成的地图会比1.1更大,自由度更高。

    进入页面选择wsad这几个按键,按住shift就能自由跑了。

    图片

    puls版本生成效果会比1.1版本生成的延展度会好一些,

    最后拿两张OPC办公空间的照片喂给1.1,

    先Image2生成一张,然后根据旋转功能,出另一个角度。

    图片

    旋转角度倾斜角度以及缩放都可以,有广角需求的话,右下角点开就行。

    图片

    生成好的两张图,拉出工作线一起连到3D世界的节点中,

    图片

    prompt:生成一张人视角度的环绕场景

    近景看得很清楚——屏幕、鼠标、笔记本、水杯、书本、显示屏,窗外的景色,这些都是我喂给它的已知内容。

    那些没有照片覆盖到的区域,它自己脑补了后面的家具摆放,脑补得还挺合理。

    图片

    如果对开始参照的图片有细节要求,在3D世界里面可以实时修改,

    我们在世界外面也可以精确修改,

    直接进入Spot Edit焦点编辑模式,点击需要修改的位置,输入你的需求就行。

    图片

    稍等片刻,红色鼠标就出来了,

    图片

    老样子,在图的右侧拉出3D世界节点,和上门同样的提示词,不输入提示词的话也会默认给你生成一个3D世界。

    图片

    03两个版本的优劣

    整体对比下来,

    Marble1.1 模型的话,倾向于画质精修优化,

    着重强化光影层次与明暗对比,完美改善前代易出现的画面过曝、整体泛白等通病,观感更通透自然。

    Marble1.1-Plus 模型,主打大场景空间生成,

    可依托原有平面图,智能延展生成超大范围 3D 场景,一键构建格局更完整、视野更开阔的全景大世界。

    所以完全可以把1.1当作提画质的铲子,puls当作构建更加宏大地图的铲子。

    3D世界模型的出现,对于往后的VR和AR产业可谓是如虎添翼。

    最后

    1999年,《异次元骇客》里有一个让我印象很深的细节。那个被创造出来的虚拟世界,边界在洛杉矶郊外一条荒凉的公路上戛然而止。

    图片

    从前的逻辑是,任何被创造出来的世界,都有它的边界。创造者能给多少,世界就延伸多少。

    但现在这个逻辑被打破了。

    你喂给AI一张图,它不会在某个地方突然停下来露出破绽。

    它会自己往外延展,自己脑补你没有给它的部分,自己决定那面墙后面是什么,那扇窗外是什么风景。

    它创造的世界没有公路尽头,没有灰白色的底层代码,只需要给它吃好底层的算力,它能给你无限的地图。

    《异次元骇客》里的人花了几十年才造出一个有边界的虚拟洛杉矶。

    图片

    而现在只需要一张图,几分钟。

    世界还是那个世界,只是造它的门槛,已经低到不像话了。

    在平台上很多优秀的创作在凭借着自己的独特的case,和超绝的执行力,完成了一个又一个具有个人表达的作品。

    目前,TapNow也正在举办一场比赛,「一万个平行宇宙」全球AI影视创作大赛,

      👉链接:https://app.tapnow.ai/event/26?tap_referral=aisjxh_gzh_20260508
      图片
      这个比赛的规则是制作自己的预告片,投入的时间和精力,最后结果肯定也不会太差,
      平台也准备了300w奖金,评委阵容和奖金规模,目前我看到是最夯的。
      今天的内容就分享到这儿,说了很多不妨亲自去体验,感受 AI 造世界的魅力,一起期待 AGI 时代更多可能。
      辛苦大家看到最后,欢迎大家推荐、点赞、关注、点⭐推荐给更多人,在此感谢每一位读者!!!
      文章标签AI资讯
      资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

      继续浏览更多资讯

      返回资讯目录

      相关资讯

      更多