💡 寻光 是什么?

一、平台定位

寻光(Xunguang,xunguang.damo-vision.com,备用 xunguang.com)由阿里巴巴达摩院视觉技术实验室研发,命名寓意"寻梦光影间",2024 年 7 月在上海世界人工智能大会(WAIC)首次公开亮相,2025 年 1 月起开放内测申请([量子位](http://m.toutiao.com/group/7388065119177081380/)、[Hello123](https://www.hello123.com/xunguang/)、[AI地带](https://www.aididai.cn/sites/10934.html)、[猫目](https://www.maomu.com/p/xunguang-com)、[AIGCbb](https://www.aigcbb.com/sites/2967.html)、[掘金实测](https://juejin.cn/post/7414027978378936374))。

不同于 Sora 等"文生视频"模型,寻光定位为PUGC 一站式 AI 视频创作平台目标是重塑传统视频制作流程,从剧本 → 分镜 → 角色 → 素材 → 编辑 → 成片全链路覆盖。核心技术架构融合多模态视觉生成 + 视频图层编辑系统,整合5500 亿参数知识图谱 + 深度学习模型行业首创系统性视频图层功能语义级精准控制(不是像素级)。

二、核心能力

寻光的能力矩阵分为 「剧本分镜 + 角色库 + 素材生成 + 视频编辑 + 运镜 + 图层 + 风格 + 配音 + 画质」 九大模块:

  • 剧本与分镜生成:输入文字描述,AI 自动生成分镜故事板,包含场景布局、角色位置、动作等,解决"凭想象绘制画面"的痛点分镜设计 3 分钟完成;
  • 角色库管理:定制专属虚拟演员智能换脸表情控制(口型匹配、点头、大吃一惊)3D 动作迁移跨场景一致性
  • 视觉素材创作:角色生图 / 文生图 / 图生视频 / 运镜控制快速产出原始素材
  • 角色换脸:在角色库中新建角色,从角色库中选择角色替换视频中的人脸
  • 目标新增:框选区域 + 提示词,如在水底视频中输入"水母",AI 生成游动的水母;
  • 目标消除:两种模型,运动目标消除模型(基于帧间信息补充,处理速度快,背景变化大)+ 稳定目标消除模型("脑补"背景,背景稳定,速度较慢);
  • 目标编辑:框选目标 + 提示词描述,如把水母改成"粉色水母",视频中的水母自动变色;
  • 风格变换:20+ 预设风格,包括梵高画、莫奈画、水彩画10 秒视频风格转绘 20 秒完成,实拍转水墨风高效;
  • 超分辨率:最高 2K(部分文章提到 4K)修复低清素材 + 老旧素材翻新 + 提升分辨率与色彩层次
  • 帧率控制:精细化调节视频帧率优化流畅度
  • 运镜控制:左右平移 / 上下平移 / 推进拉远 / 左右环绕 等多种运镜模式;
  • 运动控制:视频中目标对象的运动轨迹精细控制;
  • 前景生成:通过文本输入即可生成符合描述的、具有透明背景的视频一键融合到其他背景
  • 图层拆解:在视频第一帧选择目标,算法自动跟踪,把整段视频中对应目标拆解为独立的带透明背景的视频图层头发丝级抠像
  • 图层融合:将不同前景图层与背景融合多场景切换 / 角色复用保证场景和角色在多个镜头间的一致性
  • 语音驱动 + AI 配音:语音驱动角色唇形同步精度 98%多语种配音
  • PPT 式操作:项目抽象为分镜头面板拖拽调整顺序 / 折叠 / 展开场景降低专业工具学习门槛
  • 实时预览:编辑效果即时可视化调整运镜角度后可直接查看动态变化
  • 多场景管理:多场景 + 多分镜场景间和分镜间拖动调整顺序
  • 多屏转换:支持视频格式适配手机 / 平板 / PC跨设备兼容性
  • 一键导出:导出4K 视频(MP4 / MOV)分享协作链接

三、适用场景

寻光围绕 「影视 + 广告 + 自媒体 + 教育 + 文博 + 游戏 + 企业」 多个行业:

  • 专业影视制作:快速生成特效镜头、角色动画或分镜预览图层功能保持角色一致性(Sora 常出现角色变形),3D 场景重建复杂特效制作效率提升 80%
  • 短剧 / 中长视频:零基础制作 vlog / 短剧,10 分钟生成 1 分钟成片
  • 广告与营销:一键生成多语言字幕 + 智能换脸快速产出本土化广告(跨国品牌区域化营销);
  • 自媒体团队:快速产出营销视频支持多平台格式导出
  • 教育与培训:输入"高中生物实验课"自动生成含安全指南的动画课件教学视频 / 虚拟角色演示
  • 文博推广:博物馆可制作数字展览内容文物静态图转化为 3D 动态展示
  • 企业市场部门:制作产品宣传视频 / 教学视频 / 内部培训材料提高内容生产效率
  • 动画和游戏开发:角色定制和场景生成提供灵感和素材游戏内动画或过场视频快速原型设计
  • 社交媒体:快速生成短视频内容吸引人的 vlog / 短剧 / 创意视频
  • 广告和公关:快速生成视频广告 / 宣传材料
  • 电影和电视剧前期:辅助制作故事板 + 概念艺术团队更好规划拍摄
  • 航空模拟 / 医疗培训:未来规划垂直领域,如与国家天文台合作开发天文可视化模块

四、使用流程

「制作一段 10 秒的国风短剧'竹林少年舞剑'」 为例:

  1. 访问寻光官网 https://xunguang.damo-vision.com(或备用 https://xunguang.com);
  2. 点击「试用体验版」,手机号注册并登录申请内测资格(需注明个人 / 企业 / 机构身份);
  3. 进入创作空间,新建项目
  4. 剧本区输入文案
    清晨竹林,少年白衣执剑,晨雾弥漫,光影斑驳;少年拔剑起舞,剑光如水,剑气横扫竹叶纷飞;镜头从远景环绕推进至人物特写」;
  5. 点击「AI 生成分镜」,系统自动生成 3-5 个分镜画面,包含场景布局、角色位置、动作
  6. 进入「角色库」→ 新建角色 → 上传角色参考图 / 输入文字描述,定制专属虚拟演员保持跨场景一致性
  7. 将角色和素材拖拽到时间轴
  8. 对每个分镜选择生成方式图生视频 / 运镜控制目前视频最大时长 4 秒(早期),10 秒视频需多个分镜拼接
  9. 点击「确认分镜」生成视频,实时预览
  10. 不满意可重新生成,或使用视频编辑功能优化:
  11. 风格变换:选中视频 → 选择"水墨画"风格,10 秒视频转绘 20 秒完成;
  12. 图层拆解:框选人物,算法跟踪人物拆解为透明背景图层
  13. 图层融合:选择另一个背景视频,从素材库选择图层融合人物添加到新场景
  14. 目标消除 / 编辑 / 新增:框选 + 提示词,AI 自动处理;
  15. 运镜调整:选择推进 / 拉远 / 环绕 / 平移 运镜,实时预览
  16. 超分辨率:对低清素材选择2K 超分提升画面质量
  17. AI 配音:输入台词或上传音频,多语种配音 + 唇形同步(98% 精度)
  18. 确认所有分镜视频后,点击「导出作品」,4K MP4 / MOV 格式下载;
  19. 在我的作品中查看 / 下载,也可分享协作链接
  20. 提示:目前生成视频无背景音乐 / 配音 / 字幕需要用剪映等工具后期添加

五、产品定价

寻光目前处于内测阶段2025.1 起开放申请),定价以内测免费 + 每日 100 光点为主,未来规划企业级私有化部署方案([量子位](http://m.toutiao.com/group/7388065119177081380/)、[Hello123](https://www.hello123.com/xunguang/)、[AIGCbb](https://www.aigcbb.com/sites/2967.html)):

  • 内测版(当前):免费每日登录赠送 100"光点"(消耗型资源)基础功能体验个人 / 企业 / 机构均可申请普通用户需排队
  • 内测申请:访问官网 → 填写申请 → 注明身份 + 用途 → 等待审核 → 专业用户可申请高阶权限
  • 消耗型资源:光点是平台内统一计算单位不同功能消耗不同光点文生图 / 图生视频 / 运镜 / 图层拆解 / 风格变换 / 超分 各有消耗;
  • 资源限制:长视频生成暂限 10 秒复杂任务执行速度需提升视频最大时长 4 秒(早期阶段);
  • 未来规划:企业级私有化部署方案支持定制 API 接入价格面议
  • 垂直行业:未来扩展航空模拟 / 医疗培训等领域,与国家天文台合作开发天文可视化模块
  • 商业授权:生成内容版权归属及商用规则暂未公开说明商业项目需关注后续政策
  • 正式版定价:详见 https://xunguang.damo-vision.com 官方公示。
  • 提示:当前可免费申请内测每日 100 光点足够轻度体验专业团队可申请高阶权限商业项目关注后续正式版定价 + 商用授权

完整定价请见 https://xunguang.damo-vision.com 官方公示。

六、竞品对比

「AI 视频创作」 赛道,寻光与 可灵 AI、即梦 AI、Runway Gen-2 形成竞争:

对比维度寻光可灵 AI即梦 AIRunway Gen-2
所属公司阿里达摩院(国内)快手(国内)字节跳动剪映(国内)Runway(国外)
产品形态PUGC 一站式平台AI 视频生成 + 编辑AI 创作平台(图片+视频+数字人)AI 视频工具
核心定位影视级全流程 + 图层编辑短视频 + 商业化短视频 + 字节生态创意短片 + 实验性
文生视频核心核心(2-3分钟)核心(15秒)核心(15秒)
图生视频核心核心核心核心
运镜控制✅ 多种✅ 支持✅ 7 种✅ 镜头控制
首尾帧✅ 分镜拼接✅ 支持✅ 智能多帧 2.0🟢 支持
图层拆解✅ 行业首创 + 头发丝级❌ 无🟢 智能画布🟢 基础
图层融合✅ 透明背景 + 动态❌ 无🟢 多图融合🟢 基础
角色换脸✅ 角色库 + 3D 动作迁移🟢 支持🟢 数字人🟢 支持
风格变换✅ 20+ 风格🟢 支持🟢 12 种✅ 多种风格
剧本生分镜✅ 行业核心❌ 无✅ 故事创作模式❌ 无
角色库✅ 跨场景一致性🟢 基础✅ 数字人分身🟢 基础
AI 配音 / 唇形✅ 98% 精度✅ 支持✅ 对口型 9 秒🟢 基础
超分辨率✅ 最高 2K(部分 4K)✅ 1080p✅ 4K(Seedream 4.0)✅ 4K
多模态文本+图像+视频文本+图像四模态(Seedance 2.0)文本+图像
中文优化✅ 古风 / 成语 / 东方美学✅ 中文不错✅ 92% 准确率🟢 英文为主
全流程工作流✅ 剧本→成片全链路🟢 偏生成🟢 偏生态🟢 偏实验
起售价内测免费(每日100光点)免费 + 66 元/标准免费 + ¥79 基础$12/月起
移动端❌ 缺失✅ iOS / Android✅ iOS / Android🟢 移动端
生态阿里(淘宝/优酷/钉钉)快手字节(剪映/抖音/豆包)独立

七、数据安全

寻光作为阿里达摩院旗下 AI 视频创作平台,数据与版权按以下规则管理:

  • 研发主体:阿里巴巴达摩院视觉技术实验室国内合规阿里集团数据安全体系
  • 模型自研:5500 亿参数知识图谱 + 深度学习模型多模态视觉信号理解与生成自主可控
  • 资源消耗:光点(消耗型)是统一计算单位,不同功能消耗不同光点
  • 内容审核:对生成内容进行安全审核符合国家相关法规
  • 隐私保护:用户上传素材加密存储不用于商业用途
  • 数据加密:Web 端 HTTPS 加密阿里云安全防护
  • 账号体系:手机号注册 + 内测申请,实名认证
  • 版权提醒:要求用户确保上传素材拥有合法授权违规生成责任由用户承担
  • 商业授权:生成内容版权归属及商用规则暂未公开说明商业项目需关注后续政策
  • 企业级部署:未来规划企业级私有化部署方案支持定制 API 接入数据隔离
  • 阿里生态:淘宝 / 天猫 / 优酷 / 钉钉 / 闲鱼 30+ App 共享MNN 推理引擎 技术,基础设施稳定
  • 提示:商业项目关注后续正式版定价 + 商用授权敏感行业(金融 / 医疗 / 政企)推荐企业级私有化部署重要素材自行本地备份

八、入口说明

寻光目前提供 「Web 网页端 + 内测申请 + 协作链接」 入口,暂未提供移动端 APP

  • 官方主站:https://xunguang.damo-vision.com(主入口);
  • 备用域名:https://xunguang.com(跳转主站);
  • 使用方式:访问官网 → 点击右上角"试用体验版"手机号注册登录填写内测申请(个人 / 企业 / 机构)→ 审核通过后使用
  • 核心功能:AI 作图 / 视频生成 / 视频编辑 / 角色库 / 分镜 / 图层拆解 / 图层融合 / 风格变换 / 超分 / 运镜 / AI 配音
  • 创作空间:剧本区 + 分镜区 + 角色库 + 时间轴 + 素材库 + 多场景管理
  • 导出格式:MP4 / MOV4K 高清分享协作链接
  • 开发方:阿里巴巴达摩院视觉技术实验室负责人:陈威华(达摩院视觉技术实验室高级算法专家,WAIC 2024 公开发布人);
  • 关联技术:阿里达摩院 MNN 推理引擎(15.5K+ Stars,OSDI 2022 顶会论文30+ App / 70+ 场景);
  • 生态基础:阿里集团淘宝 / 天猫 / 优酷 / 钉钉 / 闲鱼 等 30+ App,日均千亿次调用
  • 未来入口:规划企业级私有化部署定制 API 接入移动端(待定)。

新手建议先用 https://xunguang.damo-vision.com 申请内测每日 100 光点免费体验剧本→分镜→成片全流程国风 / 中长视频 / 影视级制作首选图层拆解 + 图层融合 + 风格变换中文创作 / 东方美学 / 角色一致性推荐寻光;短视频 / 移动端推荐可灵 AI / 即梦 AI国际项目 / 创意短片推荐Runway Gen-2商业项目关注正式版定价 + 商用授权企业级需求关注后续私有化部署方案

📢特别声明

本站提供的信息都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由本站实际控制,内容如出现违规,可以直接联系网站管理员进行删除。

致力于优质、实用的网络站点资源收集与分享!

本文地址:https://www.ai-oko.com/tool/tool-afd83a3b

相关工具 20

白日梦
AI内容检测

白日梦AI是光魔科技推出的一站式AI长视频创作平台,支持输入文本一键生成最长50分钟的高质量视频。核心功能包括智能分镜设计、角色一致性保持、30+视觉风格模板、AI多声线配音与口型同步,以及静态图转动效。零门槛全流程自动化,特别适合小说推文、AI短剧、儿童绘本、营销推广等场景,帮助创作者快速将创意转化为专业视频内容。

NextCut AI
NextCut AI
AI视频工具

NextCut AI是以无限画布为核心的AI视频创作平台,集成节点式AI工作流、图像动态化、多模态内容生成和专业后期处理功能。支持Stable Diffusion、FLUX PRO等模型,提供从创意输入到8K HDR成品交付的全流程能力,适合AI漫剧、短视频和专业视频创作。

MuseArt AI
MuseArt AI
AI视频工具

Muse Art AI是多模型聚合的AI创意平台,集成Kling、Sora 2、Flux 2、Veo 3及Nano Banana 2等顶尖模型,支持4K图像生成与影视级视频创作。

AIMIX智剪
AIMIX智剪
ai-video

AIMIX智剪是一款AIGC电商内容生成平台,集批量混剪、智能分镜、AI配音、字幕生成、语音合成、智能去重于一体,接入DeepSeek大模型,单人日产2000条原创短视频,全球15,000+创作者和企业首选,电商带货和社媒矩阵批量生产利器。

有言3D视频
有言3D视频
ai-video

有言(魔珐有言)是魔珐科技推出的3D数字人AI视频生成平台,内置3000+好莱坞级超写实3D数字人形象、近千款3D场景、30+语种和400+音色,输入文字即可一键生成专业级3D数字人视频,已服务1000+头部企业(伊利/中兴/海尔/东吴证券等),

快剪辑
快剪辑
ai-video

快剪辑是360旗下的AI视频剪辑工具,支持AI成片、AI数字人、智能添加字幕、去水印等能力,为创作者提供专业级智能视频剪辑服务。

Sora
Sora
AI视频工具

Sora是OpenAI推出的AI视频生成模型,支持文本生成视频、图片生成视频和音画同步生成。Sora 2版本最长生成20秒1080p视频,具备物理真实感、角色一致性和同步音频能力,含ChatGPT Plus订阅内使用。注:Sora产品已于2026年4月关停。

宣小二新媒体
ai-video

description:宣小二是杭州龙投文化传媒推出的AI驱动企业自助式投放平台,整合10万+媒体资源与短视频达人,提供新闻发稿、自媒体发稿、短视频矩阵发布、AI代写、舆情监测等一站式服务。已服务3000+企业,是企业品牌传播与内容投放的效率工具。

LibTV
LibTV
AI视频工具

LibTV是LiblibAI推出的专业AI视频创作平台,首创无限画布+节点式工作流范式,集成30+主流AI模型(可灵、万相、Seedance等),提供角色三视图、多机位九宫格、剧情推演等20+独家功能。支持AI Agent自动化创作,5分钟一键生成完整短剧,适合AI短剧、品牌广告和影视预演。

万镜一刻
万镜一刻
AI视频工具

秒创(一帧秒创)是新壹科技推出的AI智能视频创作平台,基于新壹视频大模型,提供AI成片、数字人播报、AI视频生成、AI帮写和智能配音功能。支持100+AI音色和私有素材库,文章一键转视频,适合自媒体、企业营销和教育培训。

闪剪AI数字人
闪剪AI数字人
ai-video

闪剪AI数字人是深圳市趣推科技推出的AI短视频创作平台,30秒视频即可1:1复刻形象与声音,一键生成口播视频、直播切片、AI广告大片。集成1000+数字人形象、500+配音与DeepSeek文案,赋能个人IP、跨境电商、本地生活与企业矩阵营销。

风声雨声
ai-video

description:风声雨声是基于GPT的高质量AI翻译工具,支持epub/pdf/word/srt/txt等多格式文件翻译和中英文对照阅读,覆盖中英日韩等9种语言。翻译效果优于Google、DeepL,是读书、论文、字幕翻译利器,文件24小时自动删除保障隐私。

Viggle
Viggle
AI视频工具

Viggle是基于JST-1物理引擎的AI角色动画生成平台,支持Mix角色融合、Animate文本驱动、Move手动控制、LipSync唇形同步和Live实时直播功能。全球4000万+用户,可将静态图片转化为符合物理规律的动态视频,适合社交内容、表情包和音乐MV创作。

腾讯智影
ai-video

腾讯智影是腾讯推出的云端智能视频创作平台,集成数字人播报、AI配音、文章转视频、动态漫画、智能抹除、横转竖等AIGC能力,依托腾讯混元大模型与微信生态。提供20+数字人形象、200+音色库,支持形象克隆和声音复刻,深度打通视频号分发链路。

即创
即创
ai-video

即创是抖音推出的一站式智能创作平台,支持视频、图文和直播创作能力,为抖音创作者与商家提供AI驱动的内容生产与营销服务。

快转字幕
快转字幕
ai-video

信息齐了,输出快转字幕介绍。 快转字幕是广州比高网络科技有限公司推出的新一代AI字幕工作站,凭借68万小时标注音频训练,语音转文字准确率超98.5%,支持99+种语言识别与AI大模型翻译,独家智能重排技术让字幕断句更自然。

场辞
场辞
ai-video

``` 场辞是新片场(北京新片场传媒股份有限公司,证券代码 834630)推出的 AI 视频字幕制作工具,基于深度学习语音识别,1 小时视频最快 5 分钟出稿,准确率高达 97.5%。支持多轨制作、可视化时间轴、拍打式创建、99+ 语言方言识别,可导出 SRT/ASS/XML/MP4 等多格式字幕。

一起剪
一起剪
ai-video

一起剪是ZAKER旗下广州坚和网络科技推出的AI短视频创作平台,主打图文一键成片、AI自动剪辑、智能配音字幕、AI数字人、百万素材库、实时热点抓取与一键分发30+主流平台,云端合成几十秒出片。

怪兽AI数字人
ai-video

怪兽AI数字人是杭州怪兽智能科技打造的数字人集合式SAAS服务平台,提供数字人形象克隆+声音克隆+实时直播+短视频一键生成+IP定制+多平台分发等一体化能力。3D超写实数字人+全息交互+情感交互AI大语言模型,支持7×24小时日不落直播,30+平台一键分发,

万兴播爆
万兴播爆
AI视频工具

万兴播爆是万兴科技推出的AI数字人口播视频营销平台,提供50+超逼真4K数字人、180+场景化模板、120+语种配音,支持IP人设定制、声像复刻、智能脚本生成和智慧直播,适用于跨境电商、企业宣传、教育培训等场景。

💬 用户评论

💬
暂无评论

快来发表第一条评论吧!

🏷️ 标签

AI视频工具寻光阿里达摩院推出的全流程