把任何视频反推成可直接使用的提示词。视觉 AI 逐帧描述画面,语言模型撰写提示词——全程在你设备上完成。
你的想法和提示词永不离开你的设备。无上传、无日志、无人窥视。每一次生成都如此。
模型跑在你自己的硬件上,谁都不用付服务器账单。无 API 密钥、无配额、无付费墙——每天生成 100 条都行。
一次性下载后,模型常驻浏览器缓存。关掉 Wi-Fi 照样生成——飞行模式也没问题。
无需账户、无需邮箱、不对你的提示词做分析。模型不知道你是谁——别人也不知道。
不会。抽帧和画面描述完全在你的浏览器内完成,没有任何上传——我们也没有能接收它的服务器。加载页面后打开飞行模式,照样能用。
不能——它根据画面可见内容(主体、动作、运镜、光线、风格)重构一条提示词。原始提示词无法从成片反推,所以结果是基于画面的诚实解读。
需要:一个视觉模型负责描述画面——标准档(约 560MB)或高清档(约 1.5GB)——最终提示词由你已经在用的文字模型撰写。
浏览器能播放的格式都可以(MP4、WebM、MOV 等),且没有大小限制——因为视频根本不会离开你的设备。抽帧在本地完成,视频越长分析时间略长而已。
AI 根据画面可见内容重构提示词:主体、动作、运镜、光线、风格。它无法还原制作该视频的原始提示词——但会给出诚实、可直接使用的解读,你可在此基础上继续修改。