近日,在
联合国 AI for Good Global Summit 2026
期间,爱诗科技联合创始人谢旭璋分享了公司在实时视频、世界模型与 AI Native 互动娱乐方向的最新探索,并展示了首个构建在实时互动视频流之上的游戏引擎——PixVerse Game
, 以及来自真实创作者的多个落地探索案例。爱诗科技在世界模型与 AI 互动娱乐方向的前沿实践,受到与会联合国机构代表与全球创作者的广泛关注。当实时视频模型开始具备低延迟反馈、连续画面生成、交互理解和游戏机制承接能力,AI 视频的边界正在从内容工具,走向互动体验基础设施。

从“生成一段视频”,到“创造一个世界”
在现场分享中,谢旭璋提出,实时互动视频生成是世界模型走向大众产品化的重要路径之一。传统视频生成更像是一次性输出结果,用户输入文字或图片,模型生成一段视频;而实时互动视频生成要求模型持续接收用户输入,并让画面、声音、角色与世界状态即时发生变化。
这意味着,视频正在从“内容”变成“空间”,从“作品”变成“世界”。
在爱诗看来,世界模型不只是生成更高清、更稳定、更长的视频,而是生成一个可以被用户影响的环境。用户不再只是等待模型给出结果,而是可以在生成过程中持续改变方向、动作、剧情和世界状态,感受到“言出法随”的创新体验。
今年年初,爱诗发布了实时世界模型 PixVerse R1,让用户可以在画面持续生成的过程中实时指挥、即时得到反馈,实现"言出法随"的交互体验。在此基础上,爱诗将这一能力推进到了要求更苛刻的形态——游戏。
基于这一技术方向,爱诗在本次 AI for Good 分享了
阶段性探索 PixVerse Game——首个实时视频游戏
引擎,把完整
游戏体验构建在一条实时互动视频流之上。
它尝试用实时世界模型持续生成的画面世界,替换传统游戏中繁重的渲染与内容生产管线,并将实时视频模型、游戏机制工具链和用户自定义世界观结合起来。
换句话说,过去做游戏,需要先建模、画原画、做动画、搭场景、写脚本、调镜头等前期准备工作;而在 PixVerse Game 的设想里,创作者首先定义的是规则、目标、玩法和世界观,通过可视化工具链与类型模板即可搭建可玩的游戏体验——剩下的角色、场景、画面和叙事,都可以在实时互动中不断生成。玩家可以用自然语言直接参与世界的生成与改写。

"这不是让 AI 生成一种'像游戏的视频',而是探索一种新的游戏生产方式:To Create is to Play。创造本身,正在变成游戏的一部分。"谢旭璋表示,“我们想重新回答一个根本问题—— 游戏可以是什么,以及,谁可以创造一款游戏。"
三个真实
故事:普通人正在从玩家
,成为创世者
演讲中,还有三个来自真实用户的故事, 展示了爱诗实时互动技术的探索进展。
在 PixVerse 游戏引擎的早期内测中,创作者们已经基于该引擎构建出冒险(Adventure)、策略经营(Strategy)、动作战斗(Combat)等多个方向的游戏原型
:有人搭建了寻回“水晶铃铛”的童话王国冒险,有人做出了节奏紧凑的海边餐厅经营游戏…… 它们形态各不相同,但背后的共同点是:游戏不再完全依赖预先制作好的固定内容,而是可以随着玩家的输入实时生长。
玩家做出选择,世界随之变化;玩家改变意图,画面、角色和事件即时响应。游戏从“进入别人做好的世界”,变成“和 AI 一起把世界造出来”。

更有意思的是,这条路线并不只属于专业游戏团队。
近期,
一个由三位女性创作者发起的 AI Native 实时互动游戏项目,在小红书、B站等社区引发关注,推出即
广受好评
。
她们希望用 AI 做出自己心中更自由、更丰富的游戏体验。PixVerse 为该项目提供多模态生成能力与实时互动游戏引擎方向的技术支持,帮助创作者以远低于传统管线的成本,完成角色、场景、动态影像和互动叙事的早期表达。
游戏中有一些对角色、美术、剧情和情绪体验要求极高的品类。过去,做一个成熟角色和可玩的互动体验,往往需要专业团队、长周期制作和大量成本,可能高达3-6个月。现在,AI视频和实时互动技术让一小组创作者也有机会先把想象中的世界做出来,让玩家看见、讨论、共创,并进一步推动玩法成型,可能只需要3个星期。创作者北北表示:“对我们来说,AI 最重要的价值是让一个原本很难被立项的快穿乙女游戏,第一次有机会被看见、被验证。”
这背后的变化不是“AI 替代游戏制作”,而是创作门槛的改变。过去,普通用户只能在游戏里扮演 NPC,按照既定路线行动;现在,他们开始有机会成为造物者,自己定义角色、故事、情绪和世界规则。
爱诗也在携手包括
前叠纸 CTO Junbai
在内的游戏产业伙伴,共同探索 AI Native 游戏引擎与互动娱乐新形态。
游戏行业正在经历一个关键问题:AI 已经可以帮助内容变得“好看”,但如何让它真正“好玩”?从静态生成到实时互动,从视频画面到游戏机制,从单次内容消费到持续世界演化,这正是 PixVerse Game 试图回答的问题。

除了游戏方向,爱诗也展示了用户在
实时互动视频技术在虚拟角色与直播互动中的早期实践
。一位爱诗内部原本从事品牌工作、并无技术背景的创作者借助爱诗的实时互动技术工具,独立完成了自己的第一个互动产品——基于实时互动能力构建的 AI 虚拟主播,可以根据用户输入、礼物、弹幕和场景变化做出即时反馈。
这类尝试还处于早期,但它指向了一个清晰的方向:未来的虚拟角色不再只是被播放的内容,而可能成为可以实时回应、共同表演和参与社群互动的数字生命体。
"一个新平台真正成立的标志,不只是让专业团队更快,而是让原本不在这个行业里的人,也能开始创造。”谢旭璋表示。
从产品到
全球用户:1.5
亿人的创造工具,正为全世界打开AI新世界
这场关于"打开世界"的探索,建立在爱诗过去几年"帮助每个普通人创造视频"的积累之上。
爱诗科技成立于 2023 年,是一家 AI视频与世界模型公司,致力于推动 AI 视频从内容生产工具,走向视觉内容的高效生产、分发与实时创新交互。旗下产品主要包括全球版 PixVerse 与国内版“拍我 AI”,以及面向团队生产、开发者集成和未来交互的系列模型、产品与能力,在全球拥有超过 1.5 亿用户,覆盖 177 个国家和地区, 产品长期位居全球 AI 视频应用前列。从视频生成、角色一致性、多模态音画联合生成,到实时世界模型与实时互动引擎,爱诗坚持让前沿技术探索与真实产品体验伴生成长,让技术服务于极致用户体验与真实产品价值。
在全球创作者社区,PixVerse 已经出现一批从普通用户成长起来的代表案例:
西班牙创作者 Daria Grin 此前没有受过专业影视训练,她用 PixVerse 的角色一致性能力制作动画短片,累计播放量超过 2000 万次,由此成为独立创作者;法国艺术家 Zenith Apex 将抽象艺术概念转化为可传播的视频作品,在 YouTube 触达超过 200 万观众;一位 75 岁的英国老人,则用 PixVerse 制作出了属于自己的“人生影片”。
从西班牙的家庭创作者、巴西的社交媒体达人,到韩国年轻的导演团队,许多人在这里完成了人生第一支视频作品。
瑞士 RTS 电视台新闻报道
"联合国这个峰会叫作 AI for Good。对我们来说,它最朴素的含义是:让那些过去被创作门槛挡在门外的人,第一次拿到创造的工具。"
谢旭璋在演讲结尾表示:"过去,视频是一个结果;未来,视频是一个入口——不仅是世界创新体验的入口,也是通向游戏、直播、叙事、社交和创作者经济的入口。从生成视频,到打开世界,我们希望更多人做出的下一个作品,是属于自己的世界。"
未来,爱诗将持续推进视频生成模型、实时世界模型、游戏引擎工具链与创作者生态建设,并逐步扩大 PixVerse Game 的开放范围,让更多普通创作者、开发者和产业伙伴,一起探索 AI 时代新的娱乐形态、新的游戏入口,以及新的数字世界打开方式。
