寻光

寻光是阿里达摩院视觉技术实验室推出的一站式AI视频创作平台,主打全流程AI协同与图层编辑革命。支持剧本/分镜/角色库/运镜/图层拆解/风格变换/超分等20+功能,覆盖从剧本到成片全流程,是中文影视级视频创作的AI利器。
访问官网 ↗一、平台定位
寻光(Xunguang,xunguang.damo-vision.com,备用 xunguang.com)由阿里巴巴达摩院视觉技术实验室研发,命名寓意"寻梦光影间",2024 年 7 月在上海世界人工智能大会(WAIC)首次公开亮相,2025 年 1 月起开放内测申请([量子位](http://m.toutiao.com/group/7388065119177081380/)、[Hello123](https://www.hello123.com/xunguang/)、[AI地带](https://www.aididai.cn/sites/10934.html)、[猫目](https://www.maomu.com/p/xunguang-com)、[AIGCbb](https://www.aigcbb.com/sites/2967.html)、[掘金实测](https://juejin.cn/post/7414027978378936374))。
不同于 Sora 等"文生视频"模型,寻光定位为PUGC 一站式 AI 视频创作平台,目标是重塑传统视频制作流程,从剧本 → 分镜 → 角色 → 素材 → 编辑 → 成片全链路覆盖。核心技术架构融合多模态视觉生成 + 视频图层编辑系统,整合5500 亿参数知识图谱 + 深度学习模型,行业首创系统性视频图层功能,语义级精准控制(不是像素级)。
二、核心能力
寻光的能力矩阵分为 「剧本分镜 + 角色库 + 素材生成 + 视频编辑 + 运镜 + 图层 + 风格 + 配音 + 画质」 九大模块:
- 剧本与分镜生成:输入文字描述,AI 自动生成分镜故事板,包含场景布局、角色位置、动作等,解决"凭想象绘制画面"的痛点,分镜设计 3 分钟完成;
- 角色库管理:定制专属虚拟演员,智能换脸,表情控制(口型匹配、点头、大吃一惊),3D 动作迁移,跨场景一致性;
- 视觉素材创作:角色生图 / 文生图 / 图生视频 / 运镜控制,快速产出原始素材;
- 角色换脸:在角色库中新建角色,从角色库中选择角色替换视频中的人脸;
- 目标新增:框选区域 + 提示词,如在水底视频中输入"水母",AI 生成游动的水母;
- 目标消除:两种模型,运动目标消除模型(基于帧间信息补充,处理速度快,背景变化大)+ 稳定目标消除模型("脑补"背景,背景稳定,速度较慢);
- 目标编辑:框选目标 + 提示词描述,如把水母改成"粉色水母",视频中的水母自动变色;
- 风格变换:20+ 预设风格,包括梵高画、莫奈画、水彩画,10 秒视频风格转绘 20 秒完成,实拍转水墨风高效;
- 超分辨率:最高 2K(部分文章提到 4K),修复低清素材 + 老旧素材翻新 + 提升分辨率与色彩层次;
- 帧率控制:精细化调节视频帧率,优化流畅度;
- 运镜控制:左右平移 / 上下平移 / 推进拉远 / 左右环绕 等多种运镜模式;
- 运动控制:对视频中目标对象的运动轨迹精细控制;
- 前景生成:通过文本输入即可生成符合描述的、具有透明背景的视频,一键融合到其他背景;
- 图层拆解:在视频第一帧选择目标,算法自动跟踪,把整段视频中对应目标拆解为独立的带透明背景的视频图层,头发丝级抠像;
- 图层融合:将不同前景图层与背景融合,多场景切换 / 角色复用,保证场景和角色在多个镜头间的一致性;
- 语音驱动 + AI 配音:语音驱动角色唇形同步精度 98%,多语种配音;
- PPT 式操作:项目抽象为分镜头面板,拖拽调整顺序 / 折叠 / 展开场景,降低专业工具学习门槛;
- 实时预览:编辑效果即时可视化,调整运镜角度后可直接查看动态变化;
- 多场景管理:多场景 + 多分镜,场景间和分镜间拖动调整顺序;
- 多屏转换:支持视频格式适配手机 / 平板 / PC,跨设备兼容性;
- 一键导出:导出4K 视频(MP4 / MOV) 或分享协作链接。
三、适用场景
寻光围绕 「影视 + 广告 + 自媒体 + 教育 + 文博 + 游戏 + 企业」 多个行业:
- 专业影视制作:快速生成特效镜头、角色动画或分镜预览,图层功能保持角色一致性(Sora 常出现角色变形),3D 场景重建,复杂特效制作效率提升 80%;
- 短剧 / 中长视频:零基础制作 vlog / 短剧,10 分钟生成 1 分钟成片;
- 广告与营销:一键生成多语言字幕 + 智能换脸,快速产出本土化广告(跨国品牌区域化营销);
- 自媒体团队:快速产出营销视频,支持多平台格式导出;
- 教育与培训:输入"高中生物实验课"自动生成含安全指南的动画课件,教学视频 / 虚拟角色演示;
- 文博推广:博物馆可制作数字展览内容,文物静态图转化为 3D 动态展示;
- 企业市场部门:制作产品宣传视频 / 教学视频 / 内部培训材料,提高内容生产效率;
- 动画和游戏开发:角色定制和场景生成提供灵感和素材,游戏内动画或过场视频快速原型设计;
- 社交媒体:快速生成短视频内容,吸引人的 vlog / 短剧 / 创意视频;
- 广告和公关:快速生成视频广告 / 宣传材料;
- 电影和电视剧前期:辅助制作故事板 + 概念艺术,团队更好规划拍摄;
- 航空模拟 / 医疗培训:未来规划垂直领域,如与国家天文台合作开发天文可视化模块。
四、使用流程
以 「制作一段 10 秒的国风短剧'竹林少年舞剑'」 为例:
- 访问寻光官网 https://xunguang.damo-vision.com(或备用 https://xunguang.com);
- 点击「试用体验版」,手机号注册并登录,申请内测资格(需注明个人 / 企业 / 机构身份);
- 进入创作空间,新建项目;
- 在剧本区输入文案:
「清晨竹林,少年白衣执剑,晨雾弥漫,光影斑驳;少年拔剑起舞,剑光如水,剑气横扫竹叶纷飞;镜头从远景环绕推进至人物特写」; - 点击「AI 生成分镜」,系统自动生成 3-5 个分镜画面,包含场景布局、角色位置、动作;
- 进入「角色库」→ 新建角色 → 上传角色参考图 / 输入文字描述,定制专属虚拟演员,保持跨场景一致性;
- 将角色和素材拖拽到时间轴;
- 对每个分镜选择生成方式:图生视频 / 运镜控制,目前视频最大时长 4 秒(早期),10 秒视频需多个分镜拼接;
- 点击「确认分镜」生成视频,实时预览;
- 不满意可重新生成,或使用视频编辑功能优化:
- 风格变换:选中视频 → 选择"水墨画"风格,10 秒视频转绘 20 秒完成;
- 图层拆解:框选人物,算法跟踪,人物拆解为透明背景图层;
- 图层融合:选择另一个背景视频,从素材库选择图层融合,人物添加到新场景;
- 目标消除 / 编辑 / 新增:框选 + 提示词,AI 自动处理;
- 运镜调整:选择推进 / 拉远 / 环绕 / 平移 运镜,实时预览;
- 超分辨率:对低清素材选择2K 超分,提升画面质量;
- AI 配音:输入台词或上传音频,多语种配音 + 唇形同步(98% 精度);
- 确认所有分镜视频后,点击「导出作品」,4K MP4 / MOV 格式下载;
- 在我的作品中查看 / 下载,也可分享协作链接;
- 提示:目前生成视频无背景音乐 / 配音 / 字幕,需要用剪映等工具后期添加。
五、产品定价
寻光目前处于内测阶段(2025.1 起开放申请),定价以内测免费 + 每日 100 光点为主,未来规划企业级私有化部署方案([量子位](http://m.toutiao.com/group/7388065119177081380/)、[Hello123](https://www.hello123.com/xunguang/)、[AIGCbb](https://www.aigcbb.com/sites/2967.html)):
- 内测版(当前):免费,每日登录赠送 100"光点"(消耗型资源),基础功能体验,个人 / 企业 / 机构均可申请,普通用户需排队;
- 内测申请:访问官网 → 填写申请 → 注明身份 + 用途 → 等待审核 → 专业用户可申请高阶权限;
- 消耗型资源:光点是平台内统一计算单位,不同功能消耗不同光点,文生图 / 图生视频 / 运镜 / 图层拆解 / 风格变换 / 超分 各有消耗;
- 资源限制:长视频生成暂限 10 秒,复杂任务执行速度需提升,视频最大时长 4 秒(早期阶段);
- 未来规划:企业级私有化部署方案,支持定制 API 接入,价格面议;
- 垂直行业:未来扩展航空模拟 / 医疗培训等领域,与国家天文台合作开发天文可视化模块;
- 商业授权:生成内容版权归属及商用规则暂未公开说明,商业项目需关注后续政策;
- 正式版定价:详见 https://xunguang.damo-vision.com 官方公示。
- 提示:当前可免费申请内测,每日 100 光点足够轻度体验;专业团队可申请高阶权限;商业项目关注后续正式版定价 + 商用授权。
完整定价请见 https://xunguang.damo-vision.com 官方公示。
六、竞品对比
在 「AI 视频创作」 赛道,寻光与 可灵 AI、即梦 AI、Runway Gen-2 形成竞争:
| 对比维度 | 寻光 | 可灵 AI | 即梦 AI | Runway Gen-2 |
|---|---|---|---|---|
| 所属公司 | 阿里达摩院(国内) | 快手(国内) | 字节跳动剪映(国内) | Runway(国外) |
| 产品形态 | PUGC 一站式平台 | AI 视频生成 + 编辑 | AI 创作平台(图片+视频+数字人) | AI 视频工具 |
| 核心定位 | 影视级全流程 + 图层编辑 | 短视频 + 商业化 | 短视频 + 字节生态 | 创意短片 + 实验性 |
| 文生视频 | 核心 | 核心(2-3分钟) | 核心(15秒) | 核心(15秒) |
| 图生视频 | 核心 | 核心 | 核心 | 核心 |
| 运镜控制 | ✅ 多种 | ✅ 支持 | ✅ 7 种 | ✅ 镜头控制 |
| 首尾帧 | ✅ 分镜拼接 | ✅ 支持 | ✅ 智能多帧 2.0 | 🟢 支持 |
| 图层拆解 | ✅ 行业首创 + 头发丝级 | ❌ 无 | 🟢 智能画布 | 🟢 基础 |
| 图层融合 | ✅ 透明背景 + 动态 | ❌ 无 | 🟢 多图融合 | 🟢 基础 |
| 角色换脸 | ✅ 角色库 + 3D 动作迁移 | 🟢 支持 | 🟢 数字人 | 🟢 支持 |
| 风格变换 | ✅ 20+ 风格 | 🟢 支持 | 🟢 12 种 | ✅ 多种风格 |
| 剧本生分镜 | ✅ 行业核心 | ❌ 无 | ✅ 故事创作模式 | ❌ 无 |
| 角色库 | ✅ 跨场景一致性 | 🟢 基础 | ✅ 数字人分身 | 🟢 基础 |
| AI 配音 / 唇形 | ✅ 98% 精度 | ✅ 支持 | ✅ 对口型 9 秒 | 🟢 基础 |
| 超分辨率 | ✅ 最高 2K(部分 4K) | ✅ 1080p | ✅ 4K(Seedream 4.0) | ✅ 4K |
| 多模态 | 文本+图像+视频 | 文本+图像 | 四模态(Seedance 2.0) | 文本+图像 |
| 中文优化 | ✅ 古风 / 成语 / 东方美学 | ✅ 中文不错 | ✅ 92% 准确率 | 🟢 英文为主 |
| 全流程工作流 | ✅ 剧本→成片全链路 | 🟢 偏生成 | 🟢 偏生态 | 🟢 偏实验 |
| 起售价 | 内测免费(每日100光点) | 免费 + 66 元/标准 | 免费 + ¥79 基础 | $12/月起 |
| 移动端 | ❌ 缺失 | ✅ iOS / Android | ✅ iOS / Android | 🟢 移动端 |
| 生态 | 阿里(淘宝/优酷/钉钉) | 快手 | 字节(剪映/抖音/豆包) | 独立 |
七、数据安全
寻光作为阿里达摩院旗下 AI 视频创作平台,数据与版权按以下规则管理:
- 研发主体:阿里巴巴达摩院视觉技术实验室,国内合规,阿里集团数据安全体系;
- 模型自研:5500 亿参数知识图谱 + 深度学习模型,多模态视觉信号理解与生成,自主可控;
- 资源消耗:光点(消耗型)是统一计算单位,不同功能消耗不同光点;
- 内容审核:对生成内容进行安全审核,符合国家相关法规;
- 隐私保护:用户上传素材加密存储,不用于商业用途;
- 数据加密:Web 端 HTTPS 加密,阿里云安全防护;
- 账号体系:手机号注册 + 内测申请,实名认证;
- 版权提醒:要求用户确保上传素材拥有合法授权,违规生成责任由用户承担;
- 商业授权:生成内容版权归属及商用规则暂未公开说明,商业项目需关注后续政策;
- 企业级部署:未来规划企业级私有化部署方案,支持定制 API 接入,数据隔离;
- 阿里生态:与淘宝 / 天猫 / 优酷 / 钉钉 / 闲鱼 30+ App 共享MNN 推理引擎 技术,基础设施稳定;
- 提示:商业项目关注后续正式版定价 + 商用授权;敏感行业(金融 / 医疗 / 政企)推荐企业级私有化部署;重要素材自行本地备份。
八、入口说明
寻光目前提供 「Web 网页端 + 内测申请 + 协作链接」 入口,暂未提供移动端 APP:
- 官方主站:https://xunguang.damo-vision.com(主入口);
- 备用域名:https://xunguang.com(跳转主站);
- 使用方式:访问官网 → 点击右上角"试用体验版" → 手机号注册登录 → 填写内测申请(个人 / 企业 / 机构)→ 审核通过后使用;
- 核心功能:AI 作图 / 视频生成 / 视频编辑 / 角色库 / 分镜 / 图层拆解 / 图层融合 / 风格变换 / 超分 / 运镜 / AI 配音;
- 创作空间:剧本区 + 分镜区 + 角色库 + 时间轴 + 素材库 + 多场景管理;
- 导出格式:MP4 / MOV,4K 高清,分享协作链接;
- 开发方:阿里巴巴达摩院视觉技术实验室,负责人:陈威华(达摩院视觉技术实验室高级算法专家,WAIC 2024 公开发布人);
- 关联技术:阿里达摩院 MNN 推理引擎(15.5K+ Stars,OSDI 2022 顶会论文,30+ App / 70+ 场景);
- 生态基础:阿里集团淘宝 / 天猫 / 优酷 / 钉钉 / 闲鱼 等 30+ App,日均千亿次调用;
- 未来入口:规划企业级私有化部署、定制 API 接入、移动端(待定)。
新手建议先用 https://xunguang.damo-vision.com 申请内测,每日 100 光点免费体验剧本→分镜→成片全流程,国风 / 中长视频 / 影视级制作首选图层拆解 + 图层融合 + 风格变换,中文创作 / 东方美学 / 角色一致性推荐寻光;短视频 / 移动端推荐可灵 AI / 即梦 AI,国际项目 / 创意短片推荐Runway Gen-2;商业项目关注正式版定价 + 商用授权,企业级需求关注后续私有化部署方案。







