💡 寻光 是什么?
一、平台定位
寻光(Xunguang,xunguang.damo-vision.com,备用 xunguang.com)由阿里巴巴达摩院视觉技术实验室研发,命名寓意"寻梦光影间",2024 年 7 月在上海世界人工智能大会(WAIC)首次公开亮相,2025 年 1 月起开放内测申请([量子位](http://m.toutiao.com/group/7388065119177081380/)、[Hello123](https://www.hello123.com/xunguang/)、[AI地带](https://www.aididai.cn/sites/10934.html)、[猫目](https://www.maomu.com/p/xunguang-com)、[AIGCbb](https://www.aigcbb.com/sites/2967.html)、[掘金实测](https://juejin.cn/post/7414027978378936374))。
不同于 Sora 等"文生视频"模型,寻光定位为PUGC 一站式 AI 视频创作平台,目标是重塑传统视频制作流程,从剧本 → 分镜 → 角色 → 素材 → 编辑 → 成片全链路覆盖。核心技术架构融合多模态视觉生成 + 视频图层编辑系统,整合5500 亿参数知识图谱 + 深度学习模型,行业首创系统性视频图层功能,语义级精准控制(不是像素级)。
二、核心能力
寻光的能力矩阵分为 「剧本分镜 + 角色库 + 素材生成 + 视频编辑 + 运镜 + 图层 + 风格 + 配音 + 画质」 九大模块:
- 剧本与分镜生成:输入文字描述,AI 自动生成分镜故事板,包含场景布局、角色位置、动作等,解决"凭想象绘制画面"的痛点,分镜设计 3 分钟完成;
- 角色库管理:定制专属虚拟演员,智能换脸,表情控制(口型匹配、点头、大吃一惊),3D 动作迁移,跨场景一致性;
- 视觉素材创作:角色生图 / 文生图 / 图生视频 / 运镜控制,快速产出原始素材;
- 角色换脸:在角色库中新建角色,从角色库中选择角色替换视频中的人脸;
- 目标新增:框选区域 + 提示词,如在水底视频中输入"水母",AI 生成游动的水母;
- 目标消除:两种模型,运动目标消除模型(基于帧间信息补充,处理速度快,背景变化大)+ 稳定目标消除模型("脑补"背景,背景稳定,速度较慢);
- 目标编辑:框选目标 + 提示词描述,如把水母改成"粉色水母",视频中的水母自动变色;
- 风格变换:20+ 预设风格,包括梵高画、莫奈画、水彩画,10 秒视频风格转绘 20 秒完成,实拍转水墨风高效;
- 超分辨率:最高 2K(部分文章提到 4K),修复低清素材 + 老旧素材翻新 + 提升分辨率与色彩层次;
- 帧率控制:精细化调节视频帧率,优化流畅度;
- 运镜控制:左右平移 / 上下平移 / 推进拉远 / 左右环绕 等多种运镜模式;
- 运动控制:对视频中目标对象的运动轨迹精细控制;
- 前景生成:通过文本输入即可生成符合描述的、具有透明背景的视频,一键融合到其他背景;
- 图层拆解:在视频第一帧选择目标,算法自动跟踪,把整段视频中对应目标拆解为独立的带透明背景的视频图层,头发丝级抠像;
- 图层融合:将不同前景图层与背景融合,多场景切换 / 角色复用,保证场景和角色在多个镜头间的一致性;
- 语音驱动 + AI 配音:语音驱动角色唇形同步精度 98%,多语种配音;
- PPT 式操作:项目抽象为分镜头面板,拖拽调整顺序 / 折叠 / 展开场景,降低专业工具学习门槛;
- 实时预览:编辑效果即时可视化,调整运镜角度后可直接查看动态变化;
- 多场景管理:多场景 + 多分镜,场景间和分镜间拖动调整顺序;
- 多屏转换:支持视频格式适配手机 / 平板 / PC,跨设备兼容性;
- 一键导出:导出4K 视频(MP4 / MOV) 或分享协作链接。
三、适用场景
寻光围绕 「影视 + 广告 + 自媒体 + 教育 + 文博 + 游戏 + 企业」 多个行业:
- 专业影视制作:快速生成特效镜头、角色动画或分镜预览,图层功能保持角色一致性(Sora 常出现角色变形),3D 场景重建,复杂特效制作效率提升 80%;
- 短剧 / 中长视频:零基础制作 vlog / 短剧,10 分钟生成 1 分钟成片;
- 广告与营销:一键生成多语言字幕 + 智能换脸,快速产出本土化广告(跨国品牌区域化营销);
- 自媒体团队:快速产出营销视频,支持多平台格式导出;
- 教育与培训:输入"高中生物实验课"自动生成含安全指南的动画课件,教学视频 / 虚拟角色演示;
- 文博推广:博物馆可制作数字展览内容,文物静态图转化为 3D 动态展示;
- 企业市场部门:制作产品宣传视频 / 教学视频 / 内部培训材料,提高内容生产效率;
- 动画和游戏开发:角色定制和场景生成提供灵感和素材,游戏内动画或过场视频快速原型设计;
- 社交媒体:快速生成短视频内容,吸引人的 vlog / 短剧 / 创意视频;
- 广告和公关:快速生成视频广告 / 宣传材料;
- 电影和电视剧前期:辅助制作故事板 + 概念艺术,团队更好规划拍摄;
- 航空模拟 / 医疗培训:未来规划垂直领域,如与国家天文台合作开发天文可视化模块。
四、使用流程
以 「制作一段 10 秒的国风短剧'竹林少年舞剑'」 为例:
- 访问寻光官网 https://xunguang.damo-vision.com(或备用 https://xunguang.com);
- 点击「试用体验版」,手机号注册并登录,申请内测资格(需注明个人 / 企业 / 机构身份);
- 进入创作空间,新建项目;
- 在剧本区输入文案:
「清晨竹林,少年白衣执剑,晨雾弥漫,光影斑驳;少年拔剑起舞,剑光如水,剑气横扫竹叶纷飞;镜头从远景环绕推进至人物特写」; - 点击「AI 生成分镜」,系统自动生成 3-5 个分镜画面,包含场景布局、角色位置、动作;
- 进入「角色库」→ 新建角色 → 上传角色参考图 / 输入文字描述,定制专属虚拟演员,保持跨场景一致性;
- 将角色和素材拖拽到时间轴;
- 对每个分镜选择生成方式:图生视频 / 运镜控制,目前视频最大时长 4 秒(早期),10 秒视频需多个分镜拼接;
- 点击「确认分镜」生成视频,实时预览;
- 不满意可重新生成,或使用视频编辑功能优化:
- 风格变换:选中视频 → 选择"水墨画"风格,10 秒视频转绘 20 秒完成;
- 图层拆解:框选人物,算法跟踪,人物拆解为透明背景图层;
- 图层融合:选择另一个背景视频,从素材库选择图层融合,人物添加到新场景;
- 目标消除 / 编辑 / 新增:框选 + 提示词,AI 自动处理;
- 运镜调整:选择推进 / 拉远 / 环绕 / 平移 运镜,实时预览;
- 超分辨率:对低清素材选择2K 超分,提升画面质量;
- AI 配音:输入台词或上传音频,多语种配音 + 唇形同步(98% 精度);
- 确认所有分镜视频后,点击「导出作品」,4K MP4 / MOV 格式下载;
- 在我的作品中查看 / 下载,也可分享协作链接;
- 提示:目前生成视频无背景音乐 / 配音 / 字幕,需要用剪映等工具后期添加。
五、产品定价
寻光目前处于内测阶段(2025.1 起开放申请),定价以内测免费 + 每日 100 光点为主,未来规划企业级私有化部署方案([量子位](http://m.toutiao.com/group/7388065119177081380/)、[Hello123](https://www.hello123.com/xunguang/)、[AIGCbb](https://www.aigcbb.com/sites/2967.html)):
- 内测版(当前):免费,每日登录赠送 100"光点"(消耗型资源),基础功能体验,个人 / 企业 / 机构均可申请,普通用户需排队;
- 内测申请:访问官网 → 填写申请 → 注明身份 + 用途 → 等待审核 → 专业用户可申请高阶权限;
- 消耗型资源:光点是平台内统一计算单位,不同功能消耗不同光点,文生图 / 图生视频 / 运镜 / 图层拆解 / 风格变换 / 超分 各有消耗;
- 资源限制:长视频生成暂限 10 秒,复杂任务执行速度需提升,视频最大时长 4 秒(早期阶段);
- 未来规划:企业级私有化部署方案,支持定制 API 接入,价格面议;
- 垂直行业:未来扩展航空模拟 / 医疗培训等领域,与国家天文台合作开发天文可视化模块;
- 商业授权:生成内容版权归属及商用规则暂未公开说明,商业项目需关注后续政策;
- 正式版定价:详见 https://xunguang.damo-vision.com 官方公示。
- 提示:当前可免费申请内测,每日 100 光点足够轻度体验;专业团队可申请高阶权限;商业项目关注后续正式版定价 + 商用授权。
完整定价请见 https://xunguang.damo-vision.com 官方公示。
六、竞品对比
在 「AI 视频创作」 赛道,寻光与 可灵 AI、即梦 AI、Runway Gen-2 形成竞争:
| 对比维度 | 寻光 | 可灵 AI | 即梦 AI | Runway Gen-2 |
|---|---|---|---|---|
| 所属公司 | 阿里达摩院(国内) | 快手(国内) | 字节跳动剪映(国内) | Runway(国外) |
| 产品形态 | PUGC 一站式平台 | AI 视频生成 + 编辑 | AI 创作平台(图片+视频+数字人) | AI 视频工具 |
| 核心定位 | 影视级全流程 + 图层编辑 | 短视频 + 商业化 | 短视频 + 字节生态 | 创意短片 + 实验性 |
| 文生视频 | 核心 | 核心(2-3分钟) | 核心(15秒) | 核心(15秒) |
| 图生视频 | 核心 | 核心 | 核心 | 核心 |
| 运镜控制 | ✅ 多种 | ✅ 支持 | ✅ 7 种 | ✅ 镜头控制 |
| 首尾帧 | ✅ 分镜拼接 | ✅ 支持 | ✅ 智能多帧 2.0 | 🟢 支持 |
| 图层拆解 | ✅ 行业首创 + 头发丝级 | ❌ 无 | 🟢 智能画布 | 🟢 基础 |
| 图层融合 | ✅ 透明背景 + 动态 | ❌ 无 | 🟢 多图融合 | 🟢 基础 |
| 角色换脸 | ✅ 角色库 + 3D 动作迁移 | 🟢 支持 | 🟢 数字人 | 🟢 支持 |
| 风格变换 | ✅ 20+ 风格 | 🟢 支持 | 🟢 12 种 | ✅ 多种风格 |
| 剧本生分镜 | ✅ 行业核心 | ❌ 无 | ✅ 故事创作模式 | ❌ 无 |
| 角色库 | ✅ 跨场景一致性 | 🟢 基础 | ✅ 数字人分身 | 🟢 基础 |
| AI 配音 / 唇形 | ✅ 98% 精度 | ✅ 支持 | ✅ 对口型 9 秒 | 🟢 基础 |
| 超分辨率 | ✅ 最高 2K(部分 4K) | ✅ 1080p | ✅ 4K(Seedream 4.0) | ✅ 4K |
| 多模态 | 文本+图像+视频 | 文本+图像 | 四模态(Seedance 2.0) | 文本+图像 |
| 中文优化 | ✅ 古风 / 成语 / 东方美学 | ✅ 中文不错 | ✅ 92% 准确率 | 🟢 英文为主 |
| 全流程工作流 | ✅ 剧本→成片全链路 | 🟢 偏生成 | 🟢 偏生态 | 🟢 偏实验 |
| 起售价 | 内测免费(每日100光点) | 免费 + 66 元/标准 | 免费 + ¥79 基础 | $12/月起 |
| 移动端 | ❌ 缺失 | ✅ iOS / Android | ✅ iOS / Android | 🟢 移动端 |
| 生态 | 阿里(淘宝/优酷/钉钉) | 快手 | 字节(剪映/抖音/豆包) | 独立 |
七、数据安全
寻光作为阿里达摩院旗下 AI 视频创作平台,数据与版权按以下规则管理:
- 研发主体:阿里巴巴达摩院视觉技术实验室,国内合规,阿里集团数据安全体系;
- 模型自研:5500 亿参数知识图谱 + 深度学习模型,多模态视觉信号理解与生成,自主可控;
- 资源消耗:光点(消耗型)是统一计算单位,不同功能消耗不同光点;
- 内容审核:对生成内容进行安全审核,符合国家相关法规;
- 隐私保护:用户上传素材加密存储,不用于商业用途;
- 数据加密:Web 端 HTTPS 加密,阿里云安全防护;
- 账号体系:手机号注册 + 内测申请,实名认证;
- 版权提醒:要求用户确保上传素材拥有合法授权,违规生成责任由用户承担;
- 商业授权:生成内容版权归属及商用规则暂未公开说明,商业项目需关注后续政策;
- 企业级部署:未来规划企业级私有化部署方案,支持定制 API 接入,数据隔离;
- 阿里生态:与淘宝 / 天猫 / 优酷 / 钉钉 / 闲鱼 30+ App 共享MNN 推理引擎 技术,基础设施稳定;
- 提示:商业项目关注后续正式版定价 + 商用授权;敏感行业(金融 / 医疗 / 政企)推荐企业级私有化部署;重要素材自行本地备份。
八、入口说明
寻光目前提供 「Web 网页端 + 内测申请 + 协作链接」 入口,暂未提供移动端 APP:
- 官方主站:https://xunguang.damo-vision.com(主入口);
- 备用域名:https://xunguang.com(跳转主站);
- 使用方式:访问官网 → 点击右上角"试用体验版" → 手机号注册登录 → 填写内测申请(个人 / 企业 / 机构)→ 审核通过后使用;
- 核心功能:AI 作图 / 视频生成 / 视频编辑 / 角色库 / 分镜 / 图层拆解 / 图层融合 / 风格变换 / 超分 / 运镜 / AI 配音;
- 创作空间:剧本区 + 分镜区 + 角色库 + 时间轴 + 素材库 + 多场景管理;
- 导出格式:MP4 / MOV,4K 高清,分享协作链接;
- 开发方:阿里巴巴达摩院视觉技术实验室,负责人:陈威华(达摩院视觉技术实验室高级算法专家,WAIC 2024 公开发布人);
- 关联技术:阿里达摩院 MNN 推理引擎(15.5K+ Stars,OSDI 2022 顶会论文,30+ App / 70+ 场景);
- 生态基础:阿里集团淘宝 / 天猫 / 优酷 / 钉钉 / 闲鱼 等 30+ App,日均千亿次调用;
- 未来入口:规划企业级私有化部署、定制 API 接入、移动端(待定)。
新手建议先用 https://xunguang.damo-vision.com 申请内测,每日 100 光点免费体验剧本→分镜→成片全流程,国风 / 中长视频 / 影视级制作首选图层拆解 + 图层融合 + 风格变换,中文创作 / 东方美学 / 角色一致性推荐寻光;短视频 / 移动端推荐可灵 AI / 即梦 AI,国际项目 / 创意短片推荐Runway Gen-2;商业项目关注正式版定价 + 商用授权,企业级需求关注后续私有化部署方案。
本站提供的信息都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由本站实际控制,内容如出现违规,可以直接联系网站管理员进行删除。
致力于优质、实用的网络站点资源收集与分享!
⚡ 相关工具 20
白日梦AI是光魔科技推出的一站式AI长视频创作平台,支持输入文本一键生成最长50分钟的高质量视频。核心功能包括智能分镜设计、角色一致性保持、30+视觉风格模板、AI多声线配音与口型同步,以及静态图转动效。零门槛全流程自动化,特别适合小说推文、AI短剧、儿童绘本、营销推广等场景,帮助创作者快速将创意转化为专业视频内容。

NextCut AI是以无限画布为核心的AI视频创作平台,集成节点式AI工作流、图像动态化、多模态内容生成和专业后期处理功能。支持Stable Diffusion、FLUX PRO等模型,提供从创意输入到8K HDR成品交付的全流程能力,适合AI漫剧、短视频和专业视频创作。

Muse Art AI是多模型聚合的AI创意平台,集成Kling、Sora 2、Flux 2、Veo 3及Nano Banana 2等顶尖模型,支持4K图像生成与影视级视频创作。

AIMIX智剪是一款AIGC电商内容生成平台,集批量混剪、智能分镜、AI配音、字幕生成、语音合成、智能去重于一体,接入DeepSeek大模型,单人日产2000条原创短视频,全球15,000+创作者和企业首选,电商带货和社媒矩阵批量生产利器。

有言(魔珐有言)是魔珐科技推出的3D数字人AI视频生成平台,内置3000+好莱坞级超写实3D数字人形象、近千款3D场景、30+语种和400+音色,输入文字即可一键生成专业级3D数字人视频,已服务1000+头部企业(伊利/中兴/海尔/东吴证券等),

快剪辑是360旗下的AI视频剪辑工具,支持AI成片、AI数字人、智能添加字幕、去水印等能力,为创作者提供专业级智能视频剪辑服务。

Sora是OpenAI推出的AI视频生成模型,支持文本生成视频、图片生成视频和音画同步生成。Sora 2版本最长生成20秒1080p视频,具备物理真实感、角色一致性和同步音频能力,含ChatGPT Plus订阅内使用。注:Sora产品已于2026年4月关停。
description:宣小二是杭州龙投文化传媒推出的AI驱动企业自助式投放平台,整合10万+媒体资源与短视频达人,提供新闻发稿、自媒体发稿、短视频矩阵发布、AI代写、舆情监测等一站式服务。已服务3000+企业,是企业品牌传播与内容投放的效率工具。

LibTV是LiblibAI推出的专业AI视频创作平台,首创无限画布+节点式工作流范式,集成30+主流AI模型(可灵、万相、Seedance等),提供角色三视图、多机位九宫格、剧情推演等20+独家功能。支持AI Agent自动化创作,5分钟一键生成完整短剧,适合AI短剧、品牌广告和影视预演。

秒创(一帧秒创)是新壹科技推出的AI智能视频创作平台,基于新壹视频大模型,提供AI成片、数字人播报、AI视频生成、AI帮写和智能配音功能。支持100+AI音色和私有素材库,文章一键转视频,适合自媒体、企业营销和教育培训。

闪剪AI数字人是深圳市趣推科技推出的AI短视频创作平台,30秒视频即可1:1复刻形象与声音,一键生成口播视频、直播切片、AI广告大片。集成1000+数字人形象、500+配音与DeepSeek文案,赋能个人IP、跨境电商、本地生活与企业矩阵营销。
description:风声雨声是基于GPT的高质量AI翻译工具,支持epub/pdf/word/srt/txt等多格式文件翻译和中英文对照阅读,覆盖中英日韩等9种语言。翻译效果优于Google、DeepL,是读书、论文、字幕翻译利器,文件24小时自动删除保障隐私。

Viggle是基于JST-1物理引擎的AI角色动画生成平台,支持Mix角色融合、Animate文本驱动、Move手动控制、LipSync唇形同步和Live实时直播功能。全球4000万+用户,可将静态图片转化为符合物理规律的动态视频,适合社交内容、表情包和音乐MV创作。
腾讯智影是腾讯推出的云端智能视频创作平台,集成数字人播报、AI配音、文章转视频、动态漫画、智能抹除、横转竖等AIGC能力,依托腾讯混元大模型与微信生态。提供20+数字人形象、200+音色库,支持形象克隆和声音复刻,深度打通视频号分发链路。

即创是抖音推出的一站式智能创作平台,支持视频、图文和直播创作能力,为抖音创作者与商家提供AI驱动的内容生产与营销服务。

信息齐了,输出快转字幕介绍。 快转字幕是广州比高网络科技有限公司推出的新一代AI字幕工作站,凭借68万小时标注音频训练,语音转文字准确率超98.5%,支持99+种语言识别与AI大模型翻译,独家智能重排技术让字幕断句更自然。

``` 场辞是新片场(北京新片场传媒股份有限公司,证券代码 834630)推出的 AI 视频字幕制作工具,基于深度学习语音识别,1 小时视频最快 5 分钟出稿,准确率高达 97.5%。支持多轨制作、可视化时间轴、拍打式创建、99+ 语言方言识别,可导出 SRT/ASS/XML/MP4 等多格式字幕。

一起剪是ZAKER旗下广州坚和网络科技推出的AI短视频创作平台,主打图文一键成片、AI自动剪辑、智能配音字幕、AI数字人、百万素材库、实时热点抓取与一键分发30+主流平台,云端合成几十秒出片。
怪兽AI数字人是杭州怪兽智能科技打造的数字人集合式SAAS服务平台,提供数字人形象克隆+声音克隆+实时直播+短视频一键生成+IP定制+多平台分发等一体化能力。3D超写实数字人+全息交互+情感交互AI大语言模型,支持7×24小时日不落直播,30+平台一键分发,

万兴播爆是万兴科技推出的AI数字人口播视频营销平台,提供50+超逼真4K数字人、180+场景化模板、120+语种配音,支持IP人设定制、声像复刻、智能脚本生成和智慧直播,适用于跨境电商、企业宣传、教育培训等场景。
💬 用户评论
快来发表第一条评论吧!

