# Qwen3

共 1 篇相关文章

浏览器本地LLM实验:直接读取概率比生成JSON快

一项完全在浏览器内运行的本地实验显示,大语言模型在处理选择题时,直接读取选项概率分布无需完整文本解码。该实验支持MiniCPM5等模型在用户GPU上运行,对比了直接读取logits与逐token生成JSON两种路径的耗时差异,且数据不离开页面。