不知道该说什么
商品图里有很多细节,但哪些能作为卖点、哪些容易夸大,缺少判断依据。
Why it matters
小微商家缺少的往往不只是生成工具,而是从“这张商品图能说什么”到“怎样让镜头证明它”的完整创作路径。
商品图里有很多细节,但哪些能作为卖点、哪些容易夸大,缺少判断依据。
一句卖点如果没有对应镜头、动作和声音,只会停留在文案层。
产品变形、文字漂移、镜头过满,都可能让一支短片失去商业可用性。
The product flow
产品最重要的 Gate 不是“生成”按钮,而是用户对卖点的明确选择。这个选择会真正改变视觉风格、叙事结构、镜头和画面文案。
上传1–3张商品图;填写商品名,并提供类目或卖点。
识别类目、颜色、结构、材质细节与图片质量。
从4个有依据的候选中主动选中一个,不自动合并。
匹配视觉风格、动态方向、分镜与生成提示词。
人工复核后,将锚定图与Prompt用于外部视频模型。
脚本方向随选择变化
Generation-ready materials
当前原型暂不直接调用视频生成API。它先把创作决策转成一套结构化物料,让用户确认无误后再复制到外部平台。
商品事实、目标渠道、选中卖点及表达边界。
匹配的视觉风格、动态导演方案及选择理由。
3条与卖点绑定的英文短文案,限制3–5词。
主视觉、细节与结尾构图,分别独立生成。
时间码、景别、单一主动作和同步音效。
以独立全画幅关键帧锁定产品与镜头状态。
明确每段首尾帧、运动路径和连续性要求。
整片Prompt、负向约束、音频、锁版和人工复核项。
Visual style library
风格不是滤镜,而是服务于商品类目与选中卖点的视觉叙事方式。










Real generation evidence
同一商品已完成10种风格的外部模型实测。“悬浮几何陈列”还使用相同Prompt分别生成 Seedance 与 MiniMax 版本,用于观察模型对商品身份、镜头尺度与空间构图的解释差异。
Product boundaries
在进入会员试点前,仍需要完成淘宝/抖音真实账号上传与审核验证,并确认第三方供应商、法务隐私、客服和异常补偿规则。