资讯详情

(内含一键安装包)Qwen3.6 35B 用 8GB 显存笔记本:128K、多模态、Thinking,一键安装还能接本地 Agent

📅 2026/9/21 22:15:26 | 华诺云谱 👁 阅读
(内含一键安装包)Qwen3.6 35B 用 8GB 显存笔记本:128K、多模态、Thinking,一键安装还能接本地 Agent
先说结论短文本生成约 42.3 token/s Thinking 模式约 42.1 token/s对一台 8GB 显存、32GB 内存的笔记本来说这个结果我认为已经相当能打。9月20日更新增加了workbuddy等agent加速补丁。密码123 补丁已经包含 v1.0.1 的 WorkBuddy 正文兼容修复可以直接覆盖安装。安装器会停止服务、备份、替换并重启。旧参数35.6 秒约 414 token/s新参数16.2 秒约 908 token/s已验证Thinking 默认关闭reasoning_content 为空普通回复正常返回 hello工具调用正常多模态图片输入正常128K 上下文正常启动我自己的电脑配置RTX 4070 Laptop8GB 显存Intel i7-14650HX32GB 内存Windows 11模型是 Qwen3.6-35B-A3B 的 Q4_K_M GGUF 版本使用官方 llama.cpp CUDA 后端。现在的版本就是完整 35B 模型直接工作。一键安装环境依赖全带本地大模型最劝退人的往往不是模型而是环境。CUDA 版本不对、Python 包互相打架、编译器缺失、FFmpeg 找不到、启动参数抄错一个字符……半天就没了。我把运行需要的东西都装进包里了llama.cpp b10355CUDA 12.4 runtimecuBLASGGML CPU/CUDA 后端Microsoft VC 应用本地运行库FFmpeg 和 FFprobe完整模型与多模态 projector本地对话 UI目标电脑不需要再安装 Python、Node.js、CUDA Toolkit、Visual Studio 或 VC Redistributable。只需要 Windows 10/11、兼容的 NVIDIA 驱动、8GB 级显存和 32GB 内存。安装过程就是使用密码 123 解压安装包。双击 INSTALL_QWEN35B.bat。等待模型校验和加载。浏览器自动打开后输入密码 123。桌面会自动生成启动、停止和打开对话的快捷方式UI 可以直接添加图片视频文本文件我实际测试了发票 OCR、图表读取、一般图片问答和视频画面识别。例如图表测试能够正确返回 BETA, 7视频测试能够识别出画面中的验证码 8642。视频处理使用包内 FFmpeg不需要用户另外配置。当前 projector 不支持音频。PDF 和 Office 二进制文件也没有在浏览器端强行乱解析建议转换成文本或页面图片后再上传。Thinking 可以开也可以关UI 可以选择自动8K16K32K64K128K默认建议使用“自动”。短对话不会每次都背着 128K 历史跑随着会话增长再逐步扩大预算。可以直接接自己的本地 Agent服务提供 OpenAI 兼容接口Base URL: http://127.0.0.1:8090/v1 API key: 123 Model: qwen35b-local百度网盘https://pan.baidu.com/s/1ff1XmuJTeb_TZa2Q9vVEfw?pwdauj7提取码auj7完整安装包解压密码123UI 登录密码/API Key123安装包约 21.82 GiB请确认磁盘空间并务必完整解压后再运行安装程序。这套东西的目标不是创造一个新的模型架构也不是证明 8GB 显卡从此等于 24GB 显卡。它解决的是更具体的问题让一台普通的 8GB 显存、32GB 内存 Windows 电脑可以比较省心地跑起完整 35B、多模态、Thinking、128K 上下文并能直接接本地 Agent。模型、运行时和第三方组件遵循各自许可证。部署脚本和 UI 文件都在包内可以查看和修改。欢迎大家反馈不同显卡、CPU 和内存配置下的速度。尤其欢迎拿真实长文档、多模态任务和 Agent 工作流来测。
📝

华诺云谱内容团队

资深建站顾问 · 行业研究员

10年+企业数字化服务经验,专注智能建站、SEO优化与品牌营销,持续输出建站技巧、行业洞察与营销干货,已帮助5000+企业实现数字化增长。

你可能需要的服务

订阅华诺云谱资讯周报

每周一封,精选建站技巧、SEO与营销干货,直达邮箱。已有 8,000+ 企业主订阅,助你少走弯路。