LiteRT.js

LiteRT.js

LiteRT.js是Google于2025年7月9日开源的浏览器端AI模型推理框架,让开发者可在浏览器本地运行AI模型,数据不出设备,隐私合规友好,开发者关注度高。

LiteRT.js
访问官网 ↗

一、平台定位

LiteRT.js(前身 TensorFlow.js for LiteRT)是 Google 于 2025 年 7 月 9 日正式开源的浏览器端 AI 模型推理框架,定位"让 AI 模型在浏览器本地运行"。基于 WebAssembly + WebGPU,LiteRT.js 可在用户浏览器中直接执行 ONNX/TFLite 模型推理,无需服务器、数据不上传、零延迟,特别适合隐私敏感、低延迟、离线场景,是 Google 在端侧 AI 推理领域的核心开源项目。

二、核心能力

  • 浏览器本地推理:所有模型在用户浏览器/Web Worker 中执行,零服务器调用;
  • WebGPU 加速:利用 GPU 并行计算,推理速度较 CPU 提升 10-100 倍;
  • WebAssembly 回退:不支持 WebGPU 时自动回退到 WASM,兼容老设备;
  • 多模型支持:支持 TFLite、ONNX、PyTorch(导出)模型;
  • 多任务类型:图像分类、目标检测、语义分割、文本生成、语音识别;
  • 模型量化:支持 INT8/FP16 量化,模型体积缩小 4 倍;
  • 跨平台:Chrome/Edge/Safari/Firefox 全支持,移动端浏览器同样可用;
  • 开源生态:Apache 2.0 协议,GitHub 社区活跃。

三、适用场景

  1. 隐私敏感场景:医疗影像、金融文档、个人照片 AI 处理,数据不出设备;
  2. 离线应用:PWA 应用在无网络环境运行 AI 模型;
  3. 低延迟交互:实时滤镜、AR 试戴、实时翻译,零网络延迟;
  4. 降本增效:减少服务器推理成本与带宽,按用户数扩展;
  5. 个性化模型:每个用户可加载个性化 AI 模型,无需后端协调;
  6. 教育/演示:浏览器内直接演示 AI 能力,无需复杂环境配置。

四、使用流程

  1. 访问 LiteRT.js 官方文档 https://ai.google.dev/edge/litert
  2. 在项目中安装:npm install @litert/core 或通过 CDN 引入;
  3. 准备模型:使用 TFLite Converter 或 ONNX 导出模型,加载到项目;
  4. 在 JavaScript 中初始化 LiteRT 运行时:const runtime = new LiteRT.Runtime();
  5. 加载模型:await runtime.loadModel('model.tflite');
  6. 预处理输入(图片/音频/文本)转 Tensor;
  7. 执行推理:const output = await runtime.run(inputTensor);
  8. 后处理输出(解码、绘制、文本生成);
  9. 性能监控:使用 LiteRT Profiler 分析推理耗时,针对性优化。

五、产品定价

LiteRT.js 完全开源免费:

  • 开源协议:Apache License 2.0,可免费商用、修改、分发;
  • Google AI 托管模型:可在 Hugging Face 等社区免费下载预训练模型;
  • 企业服务:无 Google 官方企业版,依赖社区与第三方(如 Hugging Face、Modular);
  • 云服务集成:可与 Google Cloud Vertex AI 联动,混合云边推理。

无任何隐藏费用、无调用限制、无水印。

六、竞品对比

产品厂商核心定位差异化
LiteRT.jsGoogle浏览器 AI 推理框架WebGPU 加速 + 完整 ONNX/TFLite 支持
Transformers.jsHugging Face浏览器 Transformer 推理强在 NLP 模型,ONNX Runtime 底层
ONNX Runtime Web微软浏览器 ONNX 推理微软生态、跨平台
MediaPipeGoogle端侧多模态 AI 流水线强在视觉/手势/姿态实时任务

七、数据安全

  • 数据不出设备:所有推理在本地浏览器执行,零数据外传;
  • 开源可审计:Apache 2.0 协议,代码完全公开可审计;
  • 无 Google 数据收集:LiteRT.js 不嵌入 Google Analytics 等追踪代码;
  • SOC 2/ISO 27001:Google Cloud 整体通过多项合规认证;
  • 合规场景:天然符合 GDPR、HIPAA 等"数据不出设备"要求;
  • 企业私有部署:可内网部署 LiteRT.js + 自有模型,无外部依赖。

八、收录说明

LiteRT.js 于 2025 年 7 月 9 日开源,是 Google 在端侧 AI 推理的关键布局,开发者社区关注度高。AI 工具集将其收录至"AI 开发平台"分类。

主要收录理由:①Google 官方开源,权威性与社区活跃度有保障;②数据不出设备,隐私合规天然友好;③WebGPU 加速性能领先;④Apache 2.0 协议,可商用;⑤开发者关注度高,AI 边缘计算趋势明确。

官方入口:https://ai.google.dev/edge/litert

信息加载中
相关工具
QoderWork
QoderWork
QoderWork是阿里巴巴Qoder团队推出的桌面级AI智能体助手,支持自主规划执行、本地沙盒运行和MCP技能扩展,覆盖全办公场景。
AI智能体AI AgentAI办公
AutoClaw
AutoClaw
AutoClaw是智谱AI推出的一键部署OpenClaw工具,内置Pony-Alpha-2模型和50+预置技能,支持浏览器自动化和飞书集成。
AI智能体自动化AI模型
Assembo智能产品图
Assembo智能产品图
description:Assembo 智能产品图是面向电商卖家的AI产品摄影SaaS,1分钟生成Amazon、Shopify、Instagram等平台专业商品图与AI模特图。支持批量100张、HD输出、商用授权,是电商视觉降本增效利器。
AI开发平台Assembo智能产品图免费电商产品
RAGFlow
RAGFlow
专注于深度文档解析的RAG平台,支持复杂文档结构化处理,适合需要精准知识库检索的企业场景。
AI开发平台AI工具RAG
百度AI创作工具箱
百度AI创作工具箱
百度大脑智能创作平台
AI开发平台百度AI创作工具箱百度大脑智能
LlamaIndex
LlamaIndex
专注于数据连接和RAG的开源框架,支持构建企业级知识库应用,提供丰富的数据源连接器。
AI开发平台AI工具RAG
NeoDomain
NeoDomain
NeoDomain AI是基于大语言模型与多模态生成技术的创意内容生成智能体,整合记忆存储、任务规划和工具调用能力,支持文本、图像、视频、音频跨模态创作,自主拆解复杂任务并动态调整策略,实现从需求理解到内容输出的全流程自动化。
AI智能体AI Agent自动化
讯飞虚拟人
讯飞虚拟人
讯飞虚拟人是科大讯飞推出的全栈式AI虚拟人应用服务平台,集成星火大模型+语音识别+语义理解+TTS+NLP,提供讯飞智作+智能交互机+能力开放+虚拟主播+形象克隆+声音复刻+3D定制+超拟人数字人交互一站式服务。5分钟克隆真人分身,已落地新闻/金融/文旅/政务/教育等十大行业。
AI开发平台讯飞虚拟人科大讯飞推出
Dify
Dify
开源的AI应用开发平台,GitHub超10万Star,支持可视化工作流编排、RAG知识库、多模型管理,2025年新增MCP协议支持。
AI开发平台AI工具GitHub
Teamo
Teamo
Teamo是AI驱动的团队协作智能体,自动分配任务、追踪进度和识别风险,让团队协作更高效透明。
AI智能体AI AgentAI办公
百度GBI
``` 百度GBI是百度智能云推出的生成式商业智能平台,基于文心大模型4.0与千帆AppBuilder,支持自然语言对话完成数据查询、归因分析、趋势预测与可视化展示,深度整合Echarts图表库。适合业务经理、销售、运营、财务等非技术人员快速完成全链路数据分析。
AI开发平台百度GBI百度推出的全
晓语台
新工具,先搜索确认信息。 信息齐全,开始生成。 ``` 晓语台是北京字里心间科技推出的AI点击式文本创作平台,基于百度文心大模型与AIGC技术,内置500+创作模板、覆盖20+行业与30+海内外社交平台。支持自由扩写、润色、翻译、广告法检测、SEO优化等功能。
AI开发平台晓语台先进的