Skip to content

TUARAN/webllm

Repository files navigation

Qwen3.5-ONNX WebGPU Chat

基于浏览器端 transformers.jsVite 的本地多模态聊天页面,支持:

  • WebGPU 加载 Qwen ONNX 模型
  • 文本对话
  • 图片上传预览
  • IndexedDB 本地对话历史
  • 实时流式输出与 tokens/s 速度展示

目录

.
├── index.html
├── package.json
├── README.md
├── vite.config.js
└── src
    ├── main.js
    └── styles.css

运行方式

先安装依赖:

npm install

启动开发环境:

npm run dev

然后打开:

http://localhost:5173

使用说明

  1. 启动页面后先选择模型。
  2. 点击“加载模型”。
  3. 首次加载会下载模型文件,时间取决于模型大小和网络环境。
  4. 模型加载完成后,可以输入文本或上传图片开始对话。
  5. 历史会保存在浏览器 IndexedDB 中。

本次修正

  • 从 CDN 内联原型迁移到了 Vite + npm 工程结构
  • 依赖改为 @huggingface/transformers@next
  • 模型源从 huggingworld/... 修正为实际可加载的 onnx-community/...
  • 为开发和预览服务增加了 COOP/COEP 响应头,降低 WebGPU / ONNX 运行时兼容问题
  • 页面增加了运行环境提示,便于定位 WebGPU、secure context、cross-origin isolation 相关问题

已知限制

  • Qwen3.5-4B-ONNX 体积和显存压力都很大,推荐先用 0.8B 验证链路。
  • 如果浏览器或驱动不支持 WebGPU,当前实现不会自动回退到 WASM。
  • 模型下载依赖访问 Hugging Face 资源;网络受限时会直接加载失败。

About

No description, website, or topics provided.

Resources

Stars

Watchers

Forks

Releases

Packages

Contributors

Languages