LiteRT.js

LiteRT.js是Google于2025年7月9日开源的浏览器端AI模型推理框架,让开发者可在浏览器本地运行AI模型,数据不出设备,隐私合规友好,开发者关注度高。

访问LiteRT.js官网

工具介绍

一、平台定位 LiteRT.js(前身 TensorFlow.js for LiteRT)是 Google 于 2025 年 7 月 9 日正式开源的浏览器端 AI 模型推理框架,定位"让 AI 模型在浏览器本地运行"。基于 WebAssembly + WebGPU,LiteRT.js 可在用户浏览器中直接执行 ONNX/TFLite 模型推理,无需服务器、数据不上传、零延迟,特别适合隐私敏感、低延迟、离线场景,是 Google 在端侧 AI 推理领域的核心开源项目。 二、核心能力 浏览器本地推理:所有模型在用户浏览器/Web Worker 中执行,零服务器调用; WebGPU 加速:利用 GPU 并行计算,推理速度较 CPU 提升 10-100 倍; WebAssembly 回退:不支持 WebGPU 时自动回退到 WASM,兼容老设备; 多模型支持:支持 TFLite、ONNX、PyTorch(导出)模型; 多任务类型:图像分类、目标检测、语义分割、文本生成、语音识别; 模型量化:支持 INT8/FP16 量化,模型体积缩小 4 倍; 跨平台:Chrome/Edge/Saf...

标签:LiteRT.js