先给结论:第一次使用可灵 AI 3.0,不要直接选择最长时长、1080p、原生音频和多镜头。更省积分的做法是:先用 5 秒、720p、无原生音频验证主体、构图和核心动作;画面方向正确后,再逐项增加时长、清晰度、声音和参考元素。本文依据可灵官方 3.0 使用指南整理,资料核对日期为 ,不把官方演示或第三方体验冒充本站实测。
开始前:确认入口、账号与费用边界
中文用户可以从可灵 AI 官方首页进入创作平台。不要通过所谓“破解版”“共享账号”或不明镜像上传人脸、客户产品和未公开素材。模型权限、免费额度、订阅价格和活动会变化,最终以登录后账户页面显示为准。
如果你只是想先判断可灵是否适合当前任务,可以先阅读本站的免费 AI 视频工具选择指南;如果只需要确认官方域名、中文版和国际版入口,请查看可灵官网与入口说明。本教程专注于“进入平台以后怎么完成第一条视频”。
第一步:根据素材和一致性要求选择模式
| 你的任务 | 建议起点 | 原因 | 第一轮不要做什么 |
|---|---|---|---|
| 只有一句创意,想探索画面 | 文生视频 + VIDEO 3.0 | 变量最少,适合验证场景和镜头方向 | 不要同时写多个地点、人物和剧情转折 |
| 已有海报、人物图或产品图 | 图生视频 | 首帧能锁定构图与视觉主体 | 不要在提示词里重新描述一套相冲突的外观 |
| 需要一条视频内出现多个镜头 | VIDEO 3.0 多镜头 | 官方指南支持自动多镜头和自定义多镜头 | 不要在 5 秒里塞入四五个完整情节 |
| 需要人物、产品或声音跨镜头保持一致 | 元素绑定;权限允许时评估 3.0 Omni | 官方资料把参考生成和一致性作为 Omni 的重点 | 不要把单张模糊图片当作完整身份参考 |
| 只想做一个稳定的长镜头 | 关闭多镜头 | 减少自动切换机位带来的不确定性 | 不要同时要求“单镜头”和多次切镜 |
快手在可灵 3.0 官方发布说明中区分了 VIDEO 3.0 与 VIDEO 3.0 Omni:前者强化多镜头、原生音频与元素一致性,后者进一步强调参考生成和故事板控制。具体入口是否出现仍取决于地区、账户和订阅权限,不应把所有功能写成免费账号必然可用。
第二步:用六层结构写出可诊断的提示词
提示词的目标不是“越长越专业”,而是让每个失败都能定位到某一层。建议依次写:主体、动作、场景、镜头、声音、约束。如果第一轮关闭原生音频,就先省略声音层。
模板一:文生视频单镜头
主体:[一个明确主体及必要外观]
动作:[一个核心动作 + 速度/方向]
场景:[地点 + 时间 + 光线/天气]
镜头:[景别 + 机位 + 一种运镜]
声音:[环境音;角色名(语言、语气):对白]
约束:[单镜头;不要新增人物;保留指定文字]
示例:穿黄色雨衣的少年在雨夜城市中逆风跑向公交站,湿润路面反射暖色路灯。低机位中景跟拍,镜头缓慢推近。环境中有持续雨声和远处公交刹车声。单镜头,不新增路人,不切换地点。
模板二:图生视频
保持参考图中的人物外观、服装、背景和构图。
人物先看向窗外,再缓慢转头看向镜头,轻轻呼吸。
镜头小幅向前推进,窗帘被微风吹动。
不要改变脸型、服装颜色和室内陈设;不要新增人物。
图生视频的重点是“什么要动、镜头怎么动、什么不能变”,不是把图片内容再描述一遍。参考图本身已经明确的外观,不必用一长串可能冲突的形容词重写。
模板三:自定义多镜头
镜头 1(4 秒):广角固定镜头,雨夜公交站,少年跑入画面。
镜头 2(5 秒):中景侧面跟拍,少年抓紧书包,雨水落在雨衣上。
镜头 3(6 秒):车内反打近景,公交门打开,少年抬头松一口气。
全片保持同一人物、黄色雨衣和雨夜色调;环境音为雨声与车辆声。
官方指南说明,自定义多镜头可以分别描述镜头内容与时长。总时长有限时,每个镜头只承担一个叙事动作;如果一个镜头既要换地点、换人物、完成对白又要大幅运镜,失败后很难判断是哪一项造成问题。
第三步:先算积分,再选择时长、分辨率和音频
根据可灵 VIDEO 3.0 官方使用指南,VIDEO 3.0 按秒计费。下表是 2026 年 7 月 15 日核对到的官方积分档,不等于人民币订阅价格,平台后续可能调整。
| 模式 | 720p | 1080p | 5 秒示例 |
|---|---|---|---|
| 无原生音频 | 6 积分/秒 | 8 积分/秒 | 720p 30 积分;1080p 40 积分 |
| 原生音频 | 9 积分/秒 | 12 积分/秒 | 720p 45 积分;1080p 60 积分 |
| 声音控制附加项 | 在相应原生音频档基础上增加 2 积分/秒 | 1080p 原生音频 + 声音控制共 70 积分 | |
| 验证阶段 | 推荐设置 | 目的 |
|---|---|---|
| 草图 | 5 秒、720p、无音频 | 检查主体、构图、动作方向 |
| 结构确认 | 5–10 秒,保持其他参数不变 | 检查动作是否需要更多时间 |
| 声音确认 | 加入环境音或简短对白 | 检查角色与台词是否匹配 |
| 成片 | 按发布场景决定 1080p 和最长 15 秒 | 只为已经验证的方向增加成本 |
免费额度和会员套餐不是恒定事实,因此本文不写“注册送多少积分”或“每月固定价格”。最可靠的做法是登录后查看当前账户页,再用“每秒积分 × 时长”计算一轮生成的真实消耗。
第四步:生成后按症状调整,而不是盲目重抽
| 症状 | 优先检查 | 下一轮只改什么 |
|---|---|---|
| 人物或产品外观漂移 | 参考图是否清晰、角度是否足够、提示词是否改写了外观 | 补充元素参考或删除冲突的外观描述 |
| 动作扭曲、物体突然出现 | 一个镜头是否包含太多动作和交互 | 保留一个核心动作,减少同时出现的主体 |
| 多镜头顺序混乱 | 每个镜头是否有明确时长、景别和唯一任务 | 改用自定义多镜头,缩减镜头数量 |
| 角色说错台词 | 是否明确写了角色名、语言和语气 | 把每句对白绑定到角色,不同时改画面 |
| 招牌或商品文字变形 | 文字是否来自清晰参考图、画面占比是否足够 | 使用更清晰首帧并减少运镜;关键信息后期叠字 |
| 积分消耗太快 | 是否第一轮就开启 1080p、15 秒和原生音频 | 退回 5 秒、720p、无音频验证 |
第三方教程可以帮助发现常见问题,但不能代替自己的可复现记录。DataCamp 的Kling 3.0 教程展示了多镜头、元素绑定和积分计算,也提醒官方示例通常经过筛选;Creative Pad Media 的产品广告案例则报告复杂任务往往需要多次生成。两者属于独立体验,不应被改写成本站实测或普遍成功率。
第五步:导出前检查素材权利和成片风险
- 人物与声音:上传真人照片、视频或声音前,确认已经获得相应授权;不要冒充他人。
- 品牌与产品:参考图中包含商标、包装或受版权保护作品时,不要因为“AI 生成”就推定可以商用。
- 重要文字:合同条款、价格、药品说明和安全提示不要只依赖生成画面,应在后期加入可校对的文字层。
- 误导风险:涉及新闻、公共事件和真人形象时,避免让受众误以为生成画面是真实记录。
- 当前协议:生成内容的使用范围、订阅权益和地区要求应以发布当日的用户协议及账户说明为准。
可灵 3.0 新手常见问题
可灵 AI 能免费用吗?
是否有免费额度、额度多少以及可以使用哪些模型会随账户、地区和活动变化。可以免费注册查看,但不要把旧文章中的赠送积分当作长期承诺。
可灵 3.0 一次能生成 2 分钟视频吗?
官方 3.0 指南给出的单次生成范围是 3–15 秒。历史版本宣传、视频延展或多个片段拼接不能等同于“3.0 单次原生生成 2 分钟”。需要长叙事时,应拆成镜头并在剪辑软件中组合。
可灵 3.0 支持原生 4K 视频吗?
当前官方 VIDEO 3.0 积分表列出 720p 和 1080p。快手发布资料中提到的 2K/4K 主要对应图片 3.0 系列;在没有当前视频界面和官方文档证据时,不应把“图片 4K”写成“VIDEO 3.0 原生 4K 视频”。
可灵 3.0 可以生成中文对白吗?
可以。官方指南列出的原生对白语言包括中文、英文、日文、韩文和西班牙文,并支持部分方言和口音。提示词中应写清楚角色、语言、语气和台词。
VIDEO 3.0 和 3.0 Omni 怎么选?
普通文生、图生、单镜头或一般多镜头先用 VIDEO 3.0;需要参考视频、复杂元素一致性和更精细故事板时再评估 Omni。不要仅因名称更高级就默认它更适合简单任务。
资料来源与编辑说明
本文核心功能、时长、语言和积分信息来自可灵官方首页、VIDEO 3.0 Model User Guide及快手 3.0 发布说明。关于 Omni 的技术背景可参考可灵团队的Kling-Omni Technical Report。本站未在本次更新中进行付费生成基准测试,因此没有声称生成速度、成功率或竞品胜负。
想先理解产品定位,可以继续阅读KLING AI 是什么;想了解版本能力与限制,可阅读可灵 3.0 功能与费用说明。这三个页面分别服务“怎么做”“是什么”“值不值得深入用”,不会重复发布同一篇内容。