SigmaZ AI Lab 推出 Tap8 Vision:能实时对话的互动视频平台

2T超大容量网盘!点击领取 >> 原画质高清备份,上传下载不限速

在 AI 视频生成领域竞争日趋白热化的当下,一家由前亚马逊、阿里巴巴、字节跳动和百度 AI 团队成员联合创立的公司——SigmaZ AI Lab,于 7 月 22 日正式发布其旗舰产品 Tap8 Vision。这并非又一款"文生视频"工具,而是将视频从单向播放转变为实时可交互的信息界面,用户可以在播放中点击、提问、修改并即时获得反馈。

Tap8 Vision
Tap8 Vision

Tap8 的三大核心交互模式

Tap8 的定位很清楚:把视频从"只能看"变成"能动手"。它提供了三种突破性的交互方式:

1. Inspect(探查)

视频播放时,你可以拖拽、旋转、缩放或点击画面中的任意元素。Tap8 会实时理解画面内容并生成交互界面,无需预先标记任何热点区域。比如看一款 AirPods Pro 的产品介绍视频,你可以点进去查看硅胶耳塞、声学驱动单元和耳机柄的详细说明,还能体验主动降噪和空间音频的模拟效果。

2. Explore(探索)

在观看过程中提出问题——"这背后的商业模式是什么?"——Tap8 会以视频形式回答,扩展当前场景、改变呈现形态,或分支出一条平行叙事线。你可以无限延伸探索路径,主线内容始终在一步之遥等你回来。

3. Remix(重混)

在任何人的内容之上构建你自己的版本。替换主体、品牌或信息,Tap8 会根据你的意图重新生成完整视频。这为内容创作者和品牌营销打开了全新的可能性。

底层技术:DLM 扩散语言模型

Tap8 与传统 AI 视频工具最大的区别在于其底层架构。它使用的不是常规的自回归大语言模型(逐词生成),而是自研的扩散语言模型(Diffusion Language Model,DLM)

DLM 在整个场景层面进行优化而非逐帧生成,能实现实时级别的延迟,同时推理成本仅为传统 DiT(Diffusion Transformer)方案的约 1/20。这意味着实时互动视频不再是"理论上可能但贵得用不起",而是真正可以普惠的应用。

此外,Tap8 还集成了 SigmaZ 自研的 Vision-guided RSI(递归自我改进)框架。该框架能让 AI 评估并改进自身的视觉输出——系统生成前端代码、渲染为视觉结果、用视觉模型评估差异、将反馈回输给模型——形成一个持续自我优化的闭环。这一技术已于今年 4 月在里约热内卢的 ICLR 2026 RSI Workshop 上被接收,获得了学术界的第三方验证。

创始团队的愿景

SigmaZ 联合创始人兼 CEO William Yang 指出:"AI 的瓶颈不是智能,而是 AI 与人类之间的带宽。文本和语音仍然重要,但它们并不总是最自然的交互入口。我们相信未来的 AI 体验应该让用户能够直接与视觉内容对话、探索和互动。"

联合创始人兼 CTO Derek Law 补充道:"每一次媒体革命都先重写了底层技术——印刷术催生了报纸和书籍,MP3 让音乐变成自由流动的文件,流媒体成就了 YouTube 和 TikTok。我们认为 AI 是下一个这样的底层技术,而 Tap8 正从这块新土壤中生长出来。"

投资方与团队背景

SigmaZ AI Lab 的核心团队成员来自 Amazon AGI、阿里巴巴 AI Lab、字节跳动 AI 和百度等顶尖 AI 团队。公司已获得蓝驰创投、云九资本、德迅投资和小小基金等机构的投资,正在构建通用的互动视频基础设施,目标是将视频从单向内容转变为实时生成的视觉互动体验。

目前 Tap8 已开放候补名单(waitlist),用户可通过 tap8.aisigmaz.io 注册,关注后续产品更新和早期体验机会。

参考来源:PR Newswire / Morningstar / SigmaZ AI Lab

2T超大容量网盘!点击领取 >> 原画质高清备份,上传下载不限速
这是一个持续运营的鼓励
如果真的对你有用的话,感谢支持服务器及作者运营
THE END