Luma AI 是一个创意 AI 平台,官网首页把它的主张写得很直接:Luma 是你的创意伙伴,你出想法,Luma 帮你把它变成现实。 它已经不再把自己呈现为一个把句子变成片段的输入框。官网自述是覆盖视频生成与图像创作的创意 AI 平台,底层由 Ray 与 Uni 两个自研模型系列驱动,再由智能体承接端到端的创意工作流。
如果你是冲着 Dream Machine 来的,这里需要先做个说明。Dream Machine 是 2024 年让 Luma 出名的产品名,它今天仍然存在,但已经不是主入口——访问旧的 /dream-machine 路径会跳转到 /app,页面标题是「面向创意专业人士的创意智能体」。官方 API 文档更直接把旧版视频接口称为 legacy Dream Machine video API 并提供迁移指引。而在 iOS 上,移动端应用仍然以 Dream Machine 之名上架。这个品牌分叉有实际影响:如果你在 App Store 里搜「Luma Agents」,是找不到那个应用的。
公司主体是 Luma AI, Inc.,位于加州 Palo Alto。官网公布的使命是构建能够在物理世界中生成、理解并运作的统一通用智能——这个表述把视频生成放在了手段而非目的的位置。CNBC 在 2025 年 11 月的独立报道中,把 Luma 描述为开发多模态「世界模型」的公司,其模型不只从文本学习,也从视频、音频和图像中学习以模拟现实。同一篇报道中,CNBC 确认了由沙特公共投资基金旗下 Humain 领投的 9 亿美元融资,AMD 风投部门与 a16z、Amplify Partners、Matrix Partners 跟投,公司估值超过 40 亿美元。
智能体这个词在 AI 营销里被用滥了,所以有必要说清它在这个产品里的具体所指。官方的定义是嵌入你的工作流、带着跨团队的共享上下文端到端推进工作。由此派生出三个机制:
官方 FAQ 把使用方法讲得很白:你的指令应当优先说明想要什么,而不是该怎么做——把自己当导演,而不是事事插手的微观管理者。这句话值得记住,因为它解释了为什么把提示词写成软件命令的人,在这里的效果往往不如把提示词写成创意简报的人。
这个平台不是把一个模型套个壳,但也不全是自研。Luma 自研 Ray3.2、Uni-1 与 Ray3.14,除此之外还编排接入了 Nano Banana、Nano Banana Pro、GPT Image 2、Seedream、Veo 3.1、Kling 3.0、Kling Omni、Seedance 2.0,以及 ElevenLabs 的三款音频模型(语音、音效、音乐)。对一家模型公司来说这种坦率不太常见——Luma 把竞品模型的积分单价直接公示在自己的定价表里,Plus 档的权益说明也直白写着「Luma 及第三方图像与视频模型」。
实际含义是:Luma 竞争的是编排能力与工作流,而不是「只有我家模型好」。某个镜头如果 Veo 3.1 更合适,你不需要为此再买一份订阅。
Ray3.2 是旗舰视频模型,在拥挤的 AI 视频生成赛道里,它的差异化在控制力而非新奇度。Multi-Keyframe 允许在单条片段内设置最多 16 个关键帧,让你按镜头的节奏逐段指定什么变、什么不变,而不是被动接受模型自行发挥的运动。对任何被「每次重新生成整个场景都被重新诠释一遍」折磨过的人来说,这是整页里最有实际价值的一项能力。
分辨率与时长有明确数字:全模式 1080p 输出,视频改写支持最长 20 秒。
这是把 Luma 与纯文生视频工具区分开的能力。Modify Video V2 重塑你已有的素材:换掉墙、换掉世界、换掉服装,而光照保持、表演存活,支持最长 20 秒、全程 1080p。 你带来真实拍摄的素材,模型改变表演周围的世界,而不是把表演本身重新生成一遍。
官方公布的改写能力共八项:运动迁移(把动态迁移到不同角色、物体与材质上)、摄影机运动迁移(把电影化运镜迁移到不同场景与风格)、角色变换(把人变成全新角色同时保住表演)、视觉特效(在保持场景一致性的前提下做电影级效果)、环境更换(切换场景、季节乃至整个世界)、重打光(匹配不同环境或时间的光照)、产品替换(不重拍即可换掉画面中的产品)、全球化 campaign(生成分市场的创意变体)。
配套支撑的还有增强版运动迁移、用于保持身体动作与姿态的表演追踪,以及在保住角色身份的同时迁移面部表情的表现力面部表演。
多数 AI 视频工具止步于一个 MP4,Luma 没有。Ray3.2 提供原生 16-bit HDR 生成——从第一次渲染就是鲜艳、准确、可调色的,而不是事后转换出来的。对专业流程更重要的是 EXR 导出:用于调色、合成与视觉特效的 16-bit EXR 帧序列,色彩空间为 ACES2065-1(AP0),开箱即可进入合成流程。
官方把理由说得很清楚:原生 HDR 生成与 16-bit EXR 导出的存在,是为了让 AI 素材能在用户的 Resolve 或 Nuke 里与实拍素材并排合成。如果你所在的机构在 DaVinci Resolve 或 Nuke 里完成成片,这项规格直接决定了生成素材究竟能进入你的时间线,还是只能当参考图看。
需要注意的是,这个画质带来直接的成本倍数,详见下文价格章节。
图像侧的 Uni-1 被定位为模型层面的品牌智能,可把风格参考、角色参考与视觉基准带进每一件产出物。API 侧的实现暴露了它的架构:一个推理端点,一个生成端点——模型先思考再产出,所以第一版通常就是对的那版。 Luma 称 Uni-1.1 相比前代把价格与延迟都降低了一半。该说法为厂商自报,未经独立审计。
近期新增的四项能力补齐了生产侧:Luma Skills 把你搭好一次的工作流固化为可反复运行的技能;Team Workspaces 共享积分并集中管理用量;Export for Production 交付高质量 EXR 文件;从素材到交付物则覆盖片段拼接、加字幕与成片。
Luma 官方公布了一份很具体的场景清单,比笼统的承诺有用得多。反复出现的模式是「在保持一致性的前提下上规模」——同一个创意想法的大量变体,且都守得住品牌。
无限品牌视觉探索——统筹一整套多素材 campaign,视觉统一、变体齐备、可直接投放各渠道——是旗舰场景,也是智能体架构最能体现价值的地方。相关场景还有分渠道短视频广告(从文生视频的初稿出发,带钩子、字幕和各平台适配版式)与更聪明的 A/B 测试变体(做应用商店截图的多版式对比)。全球化 campaign 是其中最能直接省钱的一项:不必按地区重拍,直接生成分市场变体。
全角度产品视觉覆盖电商、社媒与各类市场平台所需的精修生活场景图与主图。全角度上身实拍可产出多种姿态、体型与穿搭情境下的真实感上身图。包装与标签样机用照片级 3D 呈现包装,从货架视角到特写。视频侧的产品替换把同一逻辑延伸到动态素材:不重拍、不手动剪辑,直接把产品换掉。
全支线分镜覆盖角色设定、故事线与分集板的开发,再把试播集做出来。书籍、游戏或影片预告面向定调、造悬念的短片。这一段是 HDR 与 EXR 输出最关键的场景,因为叙事作品要走调色流程,而不是直接发到信息流。
把视频本地化为多种语言可翻译并本地化视频,配上自然的旁白与同步的画面。清单里的 ElevenLabs 模型正是让这件事能在单一工具内闭环、而不必再找配音供应商的原因。
智能驱动的教案可生成配齐视觉素材与指导说明的完整教案。学术内容可视化把复杂系统变成带标注、易跟随的动态图示。可直接演示的幻灯片把想法转成结构清晰的 deck。播客片段转视频把音频变成带字幕、画面与 B-roll 的可分享片段。数据转信息图则是它的静态版本。
官方推荐的入口不是提示词输入框。学习中心的建议是:直接进去开始创作——先跟着引导式工作流走,然后复制该 board,改成你自己的。 Board 是这个产品的组织单元;从一个能跑通的样例出发再改,比从零开始更快摸清系统的惯例。
回想官方那句指引:优先说明想要什么,而不是怎么做;当导演,别当微观管理者。落到实处就是:说清主体、场景、氛围、镜头行为与最终交付格式,然后让智能体自己选模型、自己定操作顺序。把机械细节规定得太死,反而会跟编排层打架。
积分表让这条工作纪律变得不言自明。在 Ray3.2 上,5 秒 SDR 生成在 Draft 档是 20 积分,540p 是 50 积分,720p 是 100 积分,1080p 是 400 积分。低分辨率打草稿的花费只有 1080p 成片的二十分之一。先用低成本探构图与运动,再只把成立的那几条渲成品。
如果手上有可用的实拍素材,走 Modify Video 几乎总比从零生成更划算:表演与节奏本来就是对的,你只是让模型改变世界而不是发明一个世界。设好运动与结构参数,另需注意官方说明——源视频帧率会影响输出时长。
如果一个镜头需要卡住特定时刻——产品揭示、转身、表情变化——用关键帧去落点,而不是用散文去描述先后顺序。每条片段最多 16 个关键帧,足够编排绝大多数单镜头。
在最终渲染之前就定好 SDR、HDR 还是 HDR+EXR,因为顶格的格式会把价格乘到三倍。社媒交付很少需要 EXR,而要走调色的广告片则一定需要。
一旦某条工作流稳定出好结果,就把它变成 Luma Skill:创意工作流搭一次,往后一直跑。在周期性的 campaign 工作上,单素材耗时正是在这一步真正塌下来的。
广告公司与品牌工作室是最清晰的目标群体,官网展示的客户名单也印证了这一点:Serviceplan、电通、Humain、Aperture、阳狮集团、Boundless、马自达与 Uncharted。这些是厂商自选展示的背书而非经独立核实的案例研究,但「在卖给谁」这件事已经很明确。具名评价分别来自 Aperture 首席执行官 Hannah Paravez、Boundless 联席首席创意官 Fran Luckin、The Wonder Project 创始人 Jon Erwin,以及阳狮集团中东与土耳其区首席执行官 Bassel Kakish。
品牌内部的内容团队在需要周期性产出 campaign 素材时受益最大——Skills 与共享上下文的价值正体现在同一条工作流换不同输入反复跑。
后期与视效机构由 EXR 与 ACES2065-1 输出路径专门覆盖。如果你们的成片在 Resolve 或 Nuke 里完成,Luma 是少数能输出进这条流程、而不是停在流程旁边的生成工具。
要把生成能力接进自家产品的研发团队由 API 覆盖,按美元计价,且 Scale 档带 SLA。
教育工作者与课程作者能把教案生成与学术可视化当作一等场景使用,官方另设有教育项目。
不太适合的人群是个人爱好者与随手尝鲜的用户:没有免费档,入门即每月 30 美元,且积分经济学奖励的是规模化使用。每月只做几条片子的人,很难在单条成本上跟有免费额度的工具竞争。
网页端是主要工作环境。所有路径最终都汇集到 app.lumalabs.ai 这一个登录与创作入口,board、智能体与团队工作区都在浏览器里。
iOS 有原生应用,上架名为 Luma Dream Machine,卖家为 Luma AI, Inc.,下载免费,订阅与内购另计。撰写时的版本为 2.0.8,发布于 2026 年 4 月 17 日,要求 iOS 17.0 及以上。苹果把它归入「摄影与录像」主分类,次分类为「图形与设计」,年龄分级 12+。
API 是独立产品线,有自己的美元计价体系,视频侧为 Ray3.2、图像侧为 Uni-1.1。
专业后期流程通过 ACES2065-1 的 EXR 输出获得间接但具体的支持,官方明确其设计目标是能在 Resolve 或 Nuke 中与实拍素材并排合成。
安卓端的上架情况在撰写时未能通过一手来源确认,故此处不作任何方向的断言。(信息待验证)
这一点要先讲清楚,因为大量第三方内容的说法与此相反。Luma 的定价页没有列出任何免费档位,个人方案最便宜的入口就是付费的 Plus。
条款里确实定义了 Trials(alpha、beta 或早期访问版本),但限制很严:除非另有书面约定,期限不超过 14 天;更关键的是,试用期内产生的任何产出物仅可用于对该试用本身的内部评估与测试,不得用于其他任何目的。 Luma 对试用不提供任何保证、赔偿或支持,相关责任上限为 50 美元。所以试用并不是一条产出可发布作品的路径。
| 套餐 | 月付 | 年付(折合每月) | 积分 | 主要权益 |
|---|---|---|---|---|
| Plus | 30 美元 | 25 美元(年计 300 美元) | 10,000 | Luma 及第三方图像与视频模型;访客协作者编辑权限;商用授权 |
| Pro | 90 美元 | 75 美元(年计 900 美元) | 40,000 | 含 Plus 全部,另加 4 倍智能体用量 |
| Ultra | 300 美元 | 250 美元(年计 3,000 美元) | 150,000 | 含 Pro 全部,另加 15 倍智能体用量 |
官网标注年付最高可省 20%。
注意商用授权是作为 Plus 档的一项权益列出的,这与条款把商用权利设定为「由订阅授予」而非「自动拥有」的逻辑一致,详见下文限制章节。
Team(需联系销售)增加成员管理、项目与团队级共享、用量分析、共享团队积分与 SSO。Enterprise 再加上企业承诺、专属培训与自定义微调。
积分不是一种统一货币,消耗量随模型、动作、分辨率、时长与输出格式变化。Ray3.2 视频侧的部分档位:
| 动作 | Draft | 540p | 720p | 1080p |
|---|---|---|---|---|
| 文生/图生视频,5 秒 | 20 | 50 | 100 | 400 |
| 文生/图生视频,10 秒 | 60 | 150 | 300 | 1,200 |
| Reframe,每秒 | 10 | 20 | 40 | 120 |
输出格式在此基础上做乘法:SDR 为基准价,HDR 为 SDR 积分的 2 倍,HDR + EXR 为 3 倍。 也就是说,一条 1080p、10 秒、HDR+EXR 的片段要花 3,600 积分——单个镜头就吃掉 Plus 档月度额度的三分之一以上。
跨模型的单价差超过一个数量级:Veo 3.1 带音频在 720p 与 1080p 均为每秒 280 积分;Seedance 2.0 Mini 的 480p 为每秒 26 积分。图像侧从 Seedream 1K 的 1 积分到 GPT Image 2 高质量 4K 的 255 积分不等,Uni-1 则是统一的 30 积分。音频单独计量:ElevenLabs v3 文本转语音为每 1,000 字符 21 积分,音效每分钟 25 积分,音乐每分钟 98 积分。
API 按美元而非积分计价。Ray3.2 的文生视频与图生视频,5 秒片段:540p 为 0.15 美元,720p 为 0.30 美元,1080p 为 1.20 美元。 所示价格为 SDR 输出,HDR 为 2 倍,HDR+EXR 为 3 倍。
商务上分两档:Build 按量付费、无最低承诺,但官方明确写着有速率限制且不提供延迟 SLA;Scale 提供专属容量与保证吞吐和延迟,含 SLA、内容审核与提示词增强,并带不用于训练的保证。Scale 最低起订 4 units,1 unit 等于 Base 档每分钟 1 次请求,或 Max 档每分钟 0.4 次请求。
订阅会自动续期,按续期时的现行价格续订,除非在续期日前取消。除非 Luma 另行决定,所有费用最终且不可退款。 计费争议须在账单开出后 60 天内以书面形式提出。款项由 Stripe 处理,而非 Luma 直接处理。结合下文限制章节里的退款投诉来看,这几条正是那些争议的制度背景。
由于 Luma 内部就编排着竞品模型,「替代方案」实际上要拆成两个问题:替代的是模型,还是替代平台。
Runway 是平台层面最接近的竞争者,同样面向专业剪辑,在影视制作流程里资历更久。
Pika 面向更短的社媒内容,界面更轻、价格更低,吸引的是创作者而非广告公司。
Google Veo 与 Kling 本身就在 Luma 内部可用,所以直接选它们主要是在回答一个问题:你要不要那层编排,还是宁可用更低的成本直连模型。
OpenAI Sora 在模型层面竞争。Luma 首席执行官公开称 Ray3 的基准表现高于 Sora 2、与 Veo 3 大致相当——这是经 CNBC 转述的厂商说法,未经独立审计。
Adobe Firefly 在 Creative Cloud 集成与训练数据合规性成为采购决定性因素时更有优势。
Luma 真正的差异化在于:ACES EXR 输出路径、16 关键帧控制,以及一份订阅下的多模型编排。竞品可能胜出的地方是:可用于评估的免费额度,以及对不需要编排的团队而言更简单的单模型体验。
这是潜在买家最应该理解的一件事,而它在营销页面上完全看不到。
在 App Store 上,Luma Dream Machine 的评分是 4.5 分(满分 5 分),样本量 1,780 条——样本大、分数高。
在 Trustpilot 上,lumalabs.ai 的评分是 1.5 分,样本量 62 条。 要诚实地读这个数字,有两条限定必须说明。第一,Trustpilot 自己标注该档案未被认领,且该公司没有主动邀请用户评价的历史,因此样本可能不具代表性——自发前来评价的用户天然偏负面。第二,整个品类在该平台分数都低:同一页面上,Runway 为 1.1 分(307 条),Kling 为 1.3 分(365 条),Pika 为 1.7 分(66 条)。Luma 在品类内并非异常值。
真正有用的不是分数,而是反复出现的主题,而这些主题相当集中:
把第三类主题放到条款里读——除非 Luma 另行决定,所有费用最终且不可退款——它就不只是个别客服失职,而是一条本身就没给回旋余地的政策。做预算时请把这一点计入。
Luma 的 API FAQ 在缺陷披露上相当坦率,接入前值得读一遍。已记录的问题包括:HDR 请求回落到 Ray 3 而非 Ray 3.2;Extend 报生成失败;Reframe 面板只能用 Ray 2 且没有引擎选择器;导入的视频在 Modify 时下载失败;V2V Modify 忽略源视频运动、仅按提示词生成;以及单次点击产生多条视频导致重复计费。
条款限制在未获 4.9 条许可时将服务或产出物用于商业目的,并另行禁止在未持有允许商用的订阅时,通过非 Luma 运营的市场或商店分发、销售产出物。实践中付费套餐带商用权利——Plus 档就明确列出——但「反正生成的东西就是我的、想怎么用怎么用」这种默认预期是不成立的。试用产出物无论哪档都只限内部评估。
隐私政策把「训练、开发和改进我们用于支撑服务的人工智能、机器学习与模型」列为个人信息的使用目的之一。对照 API 的 Scale 档明确提供的不用于训练保证,图景就很清楚了:免于被用于训练是一项企业级功能,而不是默认设置。对于在正式发布前处理客户机密素材的广告公司来说,这是采购层面的考量。
条款规定用户拥有并保留产出物的全部权利、所有权与利益,Luma 将自身权益一并转让。但该转让不包括任何第三方产出物中的权利——考虑到相似提示词可能为不同用户产出相似结果,这一点值得留意。
如果你使用了可识别或类似某个真人的产出物,必须公开标明该产出物为 AI 生成。你不得就产出物的来源作虚假陈述,也不得把它谎称为人类创作。上传含真人的素材时,你须为其所有者或已获得完整授权。
条款禁止直接或间接地使用该服务或其产出物去创建、测试、训练或以其他方式开发任何 AI 或机器学习模型、系统、架构、权重及相关技术。用它批量生产合成训练数据这条路是被封死的。
Luma 可随时临时或永久地修改或停止服务的任何部分,无需通知——对重大功能的弃用会尽商业合理努力提前 30 天通知——并对由此产生的后果免责。从 Dream Machine 到 Agents 的这次转变说明,这条款不是假设性的。
Ray3 关于「首个推理型视频模型」「首个生成 16-bit HDR」的定位来自厂商自身。对比 Sora 2 与 Veo 3 的基准结论出自其首席执行官之口、由 CNBC 转述。截至撰写时,未能检索到权威科技媒体的独立实测评估。CNBC 同时提到,Dream Machine 在当年早些时候曾遭遇复制知识产权的指控,公司回应称已部署防护系统。
用户须年满 18 周岁,或在 13 至 18 周岁之间并获得父母或法定监护人同意。13 周岁以下不得使用,并适用 COPPA 声明。
不能。定价页没有列出任何免费套餐,个人最便宜的入口是每月 30 美元的 Plus(年付折合每月 25 美元)。alpha、beta 或早期访问功能的试用确实存在,但期限上限为 14 天,且产出物仅可用于内部评估与测试,不能用于可发布的作品。有些第三方文章称它有免费版,这与当前定价页不符。
在付费套餐下可以。商用授权是 Plus 档明确列出的权益,条款也允许在 4.9 条许可范围内的商业使用。产出物归你所有,Luma 将其权利转让给你。两点提醒:该转让不包括任何第三方产出物中的权利;且无论哪一档,试用期产出物都仅限内部评估。
Ray3.2 全模式输出 1080p,往下还有 540p、720p 与 Draft 档。视频改写支持最长 20 秒。清单里的其他模型更高——Seedance 2.0 与 Kling Omni 提供 4K 选项——相应的积分单价也更高。
积分按模型、动作、分辨率、时长与输出格式逐次消耗。一条 5 秒 1080p 的 Ray3.2 片段在 SDR 下是 400 积分;同一条在 HDR+EXR 下是 1,200 积分,因为 HDR 是 2 倍、HDR+EXR 是 3 倍。Plus 档的 10,000 积分,大约相当于 25 条 1080p SDR 成片——还没算迭代,而预算恰恰是消耗在迭代上的。Draft 档每 5 秒 20 积分的设计正是为此。
这个名字在 iOS 上还在,应用即以 Luma Dream Machine 上架。网页端则没有了:/dream-machine 会跳转到 /app,呈现为 Luma Agents,API 文档也把 Dream Machine 视频接口描述为 legacy 并提供迁移指引。底层的视频生成能力则以 Ray 模型线延续。
可以,而且这是 Luma 较强的一项能力。Modify Video V2 可重塑已有素材——更换环境、服装、光照或产品——同时保留原本的表演,支持最长 20 秒、1080p。相关工具还有运动迁移、摄影机运动迁移、重打光,以及用于改画幅的 Reframe。需要留意官方记录的一个已知情况:V2V Modify 有时会忽略源视频运动、仅按提示词生成。
在消费级订阅下,隐私政策把训练、开发和改进 Luma 的人工智能与机器学习模型列为其收集信息的使用目的之一。API 的 Scale 档则明确包含不用于训练的保证。如果排除训练用途是硬性要求,那指向的是企业级 API 档位,而非普通订阅。
就成片流程而言,是的,而且比多数生成工具都更适合。Ray3.2 生成原生 16-bit HDR,并导出 ACES2065-1(AP0)色彩空间的 16-bit EXR 帧序列,官方称其开箱即可合成,设计目标就是能在 Resolve 或 Nuke 中与实拍素材并排合成。请为 HDR+EXR 输出的 3 倍积分倍率预留预算。
这很大程度上取决于你看哪里。iOS 应用是 1,780 条样本下的 4.5 分。Trustpilot 是 62 条样本下的 1.5 分,但该档案未被认领、无评价邀请历史,且整个品类在该平台分数都低——Runway 1.1、Kling 1.3、Pika 1.7。跨评论一致出现的批评主题是:输出质量的日常波动、失败尝试消耗积分、以及退款难。请注意条款默认费用不可退。
有,视频侧为 Ray3.2、图像侧为 Uni-1.1。Ray3.2 的 5 秒 SDR 片段定价为 540p 0.15 美元、720p 0.30 美元、1080p 1.20 美元,HDR 为 2 倍、HDR+EXR 为 3 倍。Build 档按量付费、无最低承诺,但明确不提供延迟 SLA。Scale 档提供专属容量与保证吞吐,含 SLA、内容审核与不用于训练的保证,最低 4 units,1 unit 等于 Base 档每分钟 1 次请求。