寻光

寻光

寻光是阿里达摩院视觉技术实验室推出的一站式AI视频创作平台,主打全流程AI协同与图层编辑革命。支持剧本/分镜/角色库/运镜/图层拆解/风格变换/超分等20+功能,覆盖从剧本到成片全流程,是中文影视级视频创作的AI利器。

AI视频工具寻光阿里达摩院推出的全流程
访问官网 ↗

一、平台定位

寻光(Xunguang,xunguang.damo-vision.com,备用 xunguang.com)由阿里巴巴达摩院视觉技术实验室研发,命名寓意"寻梦光影间",2024 年 7 月在上海世界人工智能大会(WAIC)首次公开亮相,2025 年 1 月起开放内测申请([量子位](http://m.toutiao.com/group/7388065119177081380/)、[Hello123](https://www.hello123.com/xunguang/)、[AI地带](https://www.aididai.cn/sites/10934.html)、[猫目](https://www.maomu.com/p/xunguang-com)、[AIGCbb](https://www.aigcbb.com/sites/2967.html)、[掘金实测](https://juejin.cn/post/7414027978378936374))。

不同于 Sora 等"文生视频"模型,寻光定位为PUGC 一站式 AI 视频创作平台目标是重塑传统视频制作流程,从剧本 → 分镜 → 角色 → 素材 → 编辑 → 成片全链路覆盖。核心技术架构融合多模态视觉生成 + 视频图层编辑系统,整合5500 亿参数知识图谱 + 深度学习模型行业首创系统性视频图层功能语义级精准控制(不是像素级)。

二、核心能力

寻光的能力矩阵分为 「剧本分镜 + 角色库 + 素材生成 + 视频编辑 + 运镜 + 图层 + 风格 + 配音 + 画质」 九大模块:

  • 剧本与分镜生成:输入文字描述,AI 自动生成分镜故事板,包含场景布局、角色位置、动作等,解决"凭想象绘制画面"的痛点分镜设计 3 分钟完成;
  • 角色库管理:定制专属虚拟演员智能换脸表情控制(口型匹配、点头、大吃一惊)3D 动作迁移跨场景一致性
  • 视觉素材创作:角色生图 / 文生图 / 图生视频 / 运镜控制快速产出原始素材
  • 角色换脸:在角色库中新建角色,从角色库中选择角色替换视频中的人脸
  • 目标新增:框选区域 + 提示词,如在水底视频中输入"水母",AI 生成游动的水母;
  • 目标消除:两种模型,运动目标消除模型(基于帧间信息补充,处理速度快,背景变化大)+ 稳定目标消除模型("脑补"背景,背景稳定,速度较慢);
  • 目标编辑:框选目标 + 提示词描述,如把水母改成"粉色水母",视频中的水母自动变色;
  • 风格变换:20+ 预设风格,包括梵高画、莫奈画、水彩画10 秒视频风格转绘 20 秒完成,实拍转水墨风高效;
  • 超分辨率:最高 2K(部分文章提到 4K)修复低清素材 + 老旧素材翻新 + 提升分辨率与色彩层次
  • 帧率控制:精细化调节视频帧率优化流畅度
  • 运镜控制:左右平移 / 上下平移 / 推进拉远 / 左右环绕 等多种运镜模式;
  • 运动控制:视频中目标对象的运动轨迹精细控制;
  • 前景生成:通过文本输入即可生成符合描述的、具有透明背景的视频一键融合到其他背景
  • 图层拆解:在视频第一帧选择目标,算法自动跟踪,把整段视频中对应目标拆解为独立的带透明背景的视频图层头发丝级抠像
  • 图层融合:将不同前景图层与背景融合多场景切换 / 角色复用保证场景和角色在多个镜头间的一致性
  • 语音驱动 + AI 配音:语音驱动角色唇形同步精度 98%多语种配音
  • PPT 式操作:项目抽象为分镜头面板拖拽调整顺序 / 折叠 / 展开场景降低专业工具学习门槛
  • 实时预览:编辑效果即时可视化调整运镜角度后可直接查看动态变化
  • 多场景管理:多场景 + 多分镜场景间和分镜间拖动调整顺序
  • 多屏转换:支持视频格式适配手机 / 平板 / PC跨设备兼容性
  • 一键导出:导出4K 视频(MP4 / MOV)分享协作链接

三、适用场景

寻光围绕 「影视 + 广告 + 自媒体 + 教育 + 文博 + 游戏 + 企业」 多个行业:

  • 专业影视制作:快速生成特效镜头、角色动画或分镜预览图层功能保持角色一致性(Sora 常出现角色变形),3D 场景重建复杂特效制作效率提升 80%
  • 短剧 / 中长视频:零基础制作 vlog / 短剧,10 分钟生成 1 分钟成片
  • 广告与营销:一键生成多语言字幕 + 智能换脸快速产出本土化广告(跨国品牌区域化营销);
  • 自媒体团队:快速产出营销视频支持多平台格式导出
  • 教育与培训:输入"高中生物实验课"自动生成含安全指南的动画课件教学视频 / 虚拟角色演示
  • 文博推广:博物馆可制作数字展览内容文物静态图转化为 3D 动态展示
  • 企业市场部门:制作产品宣传视频 / 教学视频 / 内部培训材料提高内容生产效率
  • 动画和游戏开发:角色定制和场景生成提供灵感和素材游戏内动画或过场视频快速原型设计
  • 社交媒体:快速生成短视频内容吸引人的 vlog / 短剧 / 创意视频
  • 广告和公关:快速生成视频广告 / 宣传材料
  • 电影和电视剧前期:辅助制作故事板 + 概念艺术团队更好规划拍摄
  • 航空模拟 / 医疗培训:未来规划垂直领域,如与国家天文台合作开发天文可视化模块

四、使用流程

「制作一段 10 秒的国风短剧'竹林少年舞剑'」 为例:

  1. 访问寻光官网 https://xunguang.damo-vision.com(或备用 https://xunguang.com);
  2. 点击「试用体验版」,手机号注册并登录申请内测资格(需注明个人 / 企业 / 机构身份);
  3. 进入创作空间,新建项目
  4. 剧本区输入文案
    清晨竹林,少年白衣执剑,晨雾弥漫,光影斑驳;少年拔剑起舞,剑光如水,剑气横扫竹叶纷飞;镜头从远景环绕推进至人物特写」;
  5. 点击「AI 生成分镜」,系统自动生成 3-5 个分镜画面,包含场景布局、角色位置、动作
  6. 进入「角色库」→ 新建角色 → 上传角色参考图 / 输入文字描述,定制专属虚拟演员保持跨场景一致性
  7. 将角色和素材拖拽到时间轴
  8. 对每个分镜选择生成方式图生视频 / 运镜控制目前视频最大时长 4 秒(早期),10 秒视频需多个分镜拼接
  9. 点击「确认分镜」生成视频,实时预览
  10. 不满意可重新生成,或使用视频编辑功能优化:
  11. 风格变换:选中视频 → 选择"水墨画"风格,10 秒视频转绘 20 秒完成;
  12. 图层拆解:框选人物,算法跟踪人物拆解为透明背景图层
  13. 图层融合:选择另一个背景视频,从素材库选择图层融合人物添加到新场景
  14. 目标消除 / 编辑 / 新增:框选 + 提示词,AI 自动处理;
  15. 运镜调整:选择推进 / 拉远 / 环绕 / 平移 运镜,实时预览
  16. 超分辨率:对低清素材选择2K 超分提升画面质量
  17. AI 配音:输入台词或上传音频,多语种配音 + 唇形同步(98% 精度)
  18. 确认所有分镜视频后,点击「导出作品」,4K MP4 / MOV 格式下载;
  19. 在我的作品中查看 / 下载,也可分享协作链接
  20. 提示:目前生成视频无背景音乐 / 配音 / 字幕需要用剪映等工具后期添加

五、产品定价

寻光目前处于内测阶段2025.1 起开放申请),定价以内测免费 + 每日 100 光点为主,未来规划企业级私有化部署方案([量子位](http://m.toutiao.com/group/7388065119177081380/)、[Hello123](https://www.hello123.com/xunguang/)、[AIGCbb](https://www.aigcbb.com/sites/2967.html)):

  • 内测版(当前):免费每日登录赠送 100"光点"(消耗型资源)基础功能体验个人 / 企业 / 机构均可申请普通用户需排队
  • 内测申请:访问官网 → 填写申请 → 注明身份 + 用途 → 等待审核 → 专业用户可申请高阶权限
  • 消耗型资源:光点是平台内统一计算单位不同功能消耗不同光点文生图 / 图生视频 / 运镜 / 图层拆解 / 风格变换 / 超分 各有消耗;
  • 资源限制:长视频生成暂限 10 秒复杂任务执行速度需提升视频最大时长 4 秒(早期阶段);
  • 未来规划:企业级私有化部署方案支持定制 API 接入价格面议
  • 垂直行业:未来扩展航空模拟 / 医疗培训等领域,与国家天文台合作开发天文可视化模块
  • 商业授权:生成内容版权归属及商用规则暂未公开说明商业项目需关注后续政策
  • 正式版定价:详见 https://xunguang.damo-vision.com 官方公示。
  • 提示:当前可免费申请内测每日 100 光点足够轻度体验专业团队可申请高阶权限商业项目关注后续正式版定价 + 商用授权

完整定价请见 https://xunguang.damo-vision.com 官方公示。

六、竞品对比

「AI 视频创作」 赛道,寻光与 可灵 AI、即梦 AI、Runway Gen-2 形成竞争:

对比维度寻光可灵 AI即梦 AIRunway Gen-2
所属公司阿里达摩院(国内)快手(国内)字节跳动剪映(国内)Runway(国外)
产品形态PUGC 一站式平台AI 视频生成 + 编辑AI 创作平台(图片+视频+数字人)AI 视频工具
核心定位影视级全流程 + 图层编辑短视频 + 商业化短视频 + 字节生态创意短片 + 实验性
文生视频核心核心(2-3分钟)核心(15秒)核心(15秒)
图生视频核心核心核心核心
运镜控制✅ 多种✅ 支持✅ 7 种✅ 镜头控制
首尾帧✅ 分镜拼接✅ 支持✅ 智能多帧 2.0🟢 支持
图层拆解✅ 行业首创 + 头发丝级❌ 无🟢 智能画布🟢 基础
图层融合✅ 透明背景 + 动态❌ 无🟢 多图融合🟢 基础
角色换脸✅ 角色库 + 3D 动作迁移🟢 支持🟢 数字人🟢 支持
风格变换✅ 20+ 风格🟢 支持🟢 12 种✅ 多种风格
剧本生分镜✅ 行业核心❌ 无✅ 故事创作模式❌ 无
角色库✅ 跨场景一致性🟢 基础✅ 数字人分身🟢 基础
AI 配音 / 唇形✅ 98% 精度✅ 支持✅ 对口型 9 秒🟢 基础
超分辨率✅ 最高 2K(部分 4K)✅ 1080p✅ 4K(Seedream 4.0)✅ 4K
多模态文本+图像+视频文本+图像四模态(Seedance 2.0)文本+图像
中文优化✅ 古风 / 成语 / 东方美学✅ 中文不错✅ 92% 准确率🟢 英文为主
全流程工作流✅ 剧本→成片全链路🟢 偏生成🟢 偏生态🟢 偏实验
起售价内测免费(每日100光点)免费 + 66 元/标准免费 + ¥79 基础$12/月起
移动端❌ 缺失✅ iOS / Android✅ iOS / Android🟢 移动端
生态阿里(淘宝/优酷/钉钉)快手字节(剪映/抖音/豆包)独立

七、数据安全

寻光作为阿里达摩院旗下 AI 视频创作平台,数据与版权按以下规则管理:

  • 研发主体:阿里巴巴达摩院视觉技术实验室国内合规阿里集团数据安全体系
  • 模型自研:5500 亿参数知识图谱 + 深度学习模型多模态视觉信号理解与生成自主可控
  • 资源消耗:光点(消耗型)是统一计算单位,不同功能消耗不同光点
  • 内容审核:对生成内容进行安全审核符合国家相关法规
  • 隐私保护:用户上传素材加密存储不用于商业用途
  • 数据加密:Web 端 HTTPS 加密阿里云安全防护
  • 账号体系:手机号注册 + 内测申请,实名认证
  • 版权提醒:要求用户确保上传素材拥有合法授权违规生成责任由用户承担
  • 商业授权:生成内容版权归属及商用规则暂未公开说明商业项目需关注后续政策
  • 企业级部署:未来规划企业级私有化部署方案支持定制 API 接入数据隔离
  • 阿里生态:淘宝 / 天猫 / 优酷 / 钉钉 / 闲鱼 30+ App 共享MNN 推理引擎 技术,基础设施稳定
  • 提示:商业项目关注后续正式版定价 + 商用授权敏感行业(金融 / 医疗 / 政企)推荐企业级私有化部署重要素材自行本地备份

八、入口说明

寻光目前提供 「Web 网页端 + 内测申请 + 协作链接」 入口,暂未提供移动端 APP

  • 官方主站:https://xunguang.damo-vision.com(主入口);
  • 备用域名:https://xunguang.com(跳转主站);
  • 使用方式:访问官网 → 点击右上角"试用体验版"手机号注册登录填写内测申请(个人 / 企业 / 机构)→ 审核通过后使用
  • 核心功能:AI 作图 / 视频生成 / 视频编辑 / 角色库 / 分镜 / 图层拆解 / 图层融合 / 风格变换 / 超分 / 运镜 / AI 配音
  • 创作空间:剧本区 + 分镜区 + 角色库 + 时间轴 + 素材库 + 多场景管理
  • 导出格式:MP4 / MOV4K 高清分享协作链接
  • 开发方:阿里巴巴达摩院视觉技术实验室负责人:陈威华(达摩院视觉技术实验室高级算法专家,WAIC 2024 公开发布人);
  • 关联技术:阿里达摩院 MNN 推理引擎(15.5K+ Stars,OSDI 2022 顶会论文30+ App / 70+ 场景);
  • 生态基础:阿里集团淘宝 / 天猫 / 优酷 / 钉钉 / 闲鱼 等 30+ App,日均千亿次调用
  • 未来入口:规划企业级私有化部署定制 API 接入移动端(待定)。

新手建议先用 https://xunguang.damo-vision.com 申请内测每日 100 光点免费体验剧本→分镜→成片全流程国风 / 中长视频 / 影视级制作首选图层拆解 + 图层融合 + 风格变换中文创作 / 东方美学 / 角色一致性推荐寻光;短视频 / 移动端推荐可灵 AI / 即梦 AI国际项目 / 创意短片推荐Runway Gen-2商业项目关注正式版定价 + 商用授权企业级需求关注后续私有化部署方案

信息加载中
相关工具
白日梦
白日梦AI是光魔科技推出的一站式AI长视频创作平台,支持输入文本一键生成最长50分钟的高质量视频。核心功能包括智能分镜设计、角色一致性保持、30+视觉风格模板、AI多声线配音与口型同步,以及静态图转动效。零门槛全流程自动化,特别适合小说推文、AI短剧、儿童绘本、营销推广等场景,帮助创作者快速将创意转化为专业视频内容。
AI检测视频生成AI配音
有言3D视频
有言3D视频
有言(魔珐有言)是魔珐科技推出的3D数字人AI视频生成平台,内置3000+好莱坞级超写实3D数字人形象、近千款3D场景、30+语种和400+音色,输入文字即可一键生成专业级3D数字人视频,已服务1000+头部企业(伊利/中兴/海尔/东吴证券等),
AI视频工具有言3D视频一站式
NextCut AI
NextCut AI
NextCut AI是以无限画布为核心的AI视频创作平台,集成节点式AI工作流、图像动态化、多模态内容生成和专业后期处理功能。支持Stable Diffusion、FLUX PRO等模型,提供从创意输入到8K HDR成品交付的全流程能力,适合AI漫剧、短视频和专业视频创作。
AI视频视频生成多模态
快剪辑
快剪辑
快剪辑是360旗下的AI视频剪辑工具,支持AI成片、AI数字人、智能添加字幕、去水印等能力,为创作者提供专业级智能视频剪辑服务。
AI视频工具快剪辑旗下的
即创
即创
即创是抖音推出的一站式智能创作平台,支持视频、图文和直播创作能力,为抖音创作者与商家提供AI驱动的内容生产与营销服务。
AI视频工具即创抖音推出的一
闪剪AI数字人
闪剪AI数字人
闪剪AI数字人是深圳市趣推科技推出的AI短视频创作平台,30秒视频即可1:1复刻形象与声音,一键生成口播视频、直播切片、AI广告大片。集成1000+数字人形象、500+配音与DeepSeek文案,赋能个人IP、跨境电商、本地生活与企业矩阵营销。
AI视频工具闪剪AI数字人数字人短视频
AIMIX智剪
AIMIX智剪
AIMIX智剪是一款AIGC电商内容生成平台,集批量混剪、智能分镜、AI配音、字幕生成、语音合成、智能去重于一体,接入DeepSeek大模型,单人日产2000条原创短视频,全球15,000+创作者和企业首选,电商带货和社媒矩阵批量生产利器。
AI视频工具AIMIX智剪电商内容生成
宣小二新媒体
description:宣小二是杭州龙投文化传媒推出的AI驱动企业自助式投放平台,整合10万+媒体资源与短视频达人,提供新闻发稿、自媒体发稿、短视频矩阵发布、AI代写、舆情监测等一站式服务。已服务3000+企业,是企业品牌传播与内容投放的效率工具。
AI视频工具宣小二新媒体新媒体平台
千面视频动捕
千面视频动捕
千面视频动捕(Quick Magic)是杭州乐曼多科技旗下千面智娱AI工作室推出的AI视频动作捕捉工具,用户上传一段普通视频即可生成高质量3D动作数据,支持全身/半身/手部/面部精细捕捉和Blender/Maya/Unreal/Unity等主流3D软件格式导出,效率相比传统手K方式提升5184倍,
AI视频工具千面视频动捕上传一段视频
哔哔终结者
哔哔终结者
description:哔哔终结者BibiGPT是国内开发者JimmyLv(吕立青)推出的AI音视频助理,支持B站/YouTube/抖音/小红书/播客等30+平台及本地文件一键总结。提供带时间戳摘要、思维导图、AI视频对话、字幕翻译等功能,已服务100万+用户,是视频学习与内容创作的效率利器。
AI视频工具哔哔终结者一键总结视频
怪兽AI数字人
怪兽AI数字人是杭州怪兽智能科技打造的数字人集合式SAAS服务平台,提供数字人形象克隆+声音克隆+实时直播+短视频一键生成+IP定制+多平台分发等一体化能力。3D超写实数字人+全息交互+情感交互AI大语言模型,支持7×24小时日不落直播,30+平台一键分发,
AI视频工具怪兽AI数字人实时交互数字
风声雨声
description:风声雨声是基于GPT的高质量AI翻译工具,支持epub/pdf/word/srt/txt等多格式文件翻译和中英文对照阅读,覆盖中英日韩等9种语言。翻译效果优于Google、DeepL,是读书、论文、字幕翻译利器,文件24小时自动删除保障隐私。
AI视频工具风声雨声能够提供高质