Vitalik Buterin 的本地 AI 推送:你的笔记本电脑能取代 ChatGPT 吗?
核心要点
- Vitalik Buterin 的本地 AI 测试显示了可用速度 他的笔记本电脑使用 AMD 的 Strix Halo 芯片。
- 本地模型在设备上进行应答,因此没有提供商会收到该请求。
- Vitalik Buterin 的本地 AI 推送:你的笔记本电脑能取代 ChatGPT 吗?

以太坊联合创始人维塔利克·布特林 (Vitalik Buterin) 表示,本地人工智能 (AI) 已接近处理大部分日常任务。他在自己的笔记本上运行了阿里巴巴的Qwen3.8-Flash-Next,并发布了速度结果。与 ChatGPT 不同,该设置永远不会联系云服务器。模型坐在机器上,机器自己回答请求。 Vitalik Buterin 的本地 AI 测试显示了可用速度 他的笔记本电脑使用 AMD 的 Strix Halo 芯片。大多数计算机将工作分配给处理器和单独的显卡,并且每台计算机都保留自己的内存池。 Strix Halo 将两者放在一块硅片上,并让它们共享一个池。这种设计很重要,因为人工智能模型必须先装入内存才能运行。典型的显卡提供 8 到 24 GB 的容量,对于这种尺寸的型号来说太少了。 Strix Halo 机器配备了多达 128 GB 的内存,可供一半芯片使用。因此,一台笔记本电脑可以容纳直到最近才需要的服务器硬件型号。他发布的速度对于普通工作来说足够快了。简短的提示以舒适的阅读速度回来。一旦提示达到数万字,输出就会变慢,因此很长的文档仍然是弱点。阿里巴巴于 8 月 26 日发布了开放权重。该团队表示,该模型拥有 1250 亿个参数,但一次仅激活 60 亿个参数,这使得内存需求保持适度。 Buterin 将其命名为 Qwen3.8-Flash,尽管阿里巴巴将可下载版本命名为 Qwen3.8-Flash-Next。其较大的兄弟产品 Qwen3.8-Max 在 8 月份取得了强劲的基准分数。 Qwen 3.8 flash 确实令人印象深刻,并且 llama.cpp 在处理它方面迅速变得越来越好,列有:预先存在的提示、新提示、生成、输入 tok/s、输出 tok/s 这是在我的笔记本电脑上(strix halo)。我认为我们已经非常接近你…… pic.twitter.com/v5Ze4Fv5Wr —vitalik.eth (@VitalikButerin) 2026 年 9 月 17 日 Vitalik Buterin。来源:X 为什么隐私会改变计算方式 Buterin 看到了原始速度之外的第二个回报。本地模型在设备上进行应答,因此没有提供商会收到该请求。对于要求更高的工作,他建议拆分。本地模型将处理它能处理的事情,然后从传递到更大的托管系统的任何内容中剥离敏感细节。 “使用本地模型将查询编排到强大的模型,这样您的查询就不会泄露您的个人信息”在实践中,本地模型会从提示中提取姓名、钱包地址或私人代码,然后仅传递剩余的问题。这样的筛选会切断离开设备的部分。它不能保证不会漏掉任何敏感信息。笔记本电脑上的本地人工智能与云服务的比较图。来源:BeInCrypto 这个音调符合他的记录。他在欧盟聊天控制之争期间警告过监视,加密货币用户也出于类似原因要求对代理实施更严格的限制。 5 月份提起的一项集体诉讼指控 OpenAI 与 Meta 和 Google 共享 ChatGPT 用户查询。云提供商仍然占据着前沿。然而,本地性能的每一次提升都将更多的日常工作从服务器上转移出去,并且廉价的共享内存硬件不断普及。悬而未决的问题是人们愿意用多少能力来换取控制权。 Vitalik Buterin 的本地 AI 推送:你的笔记本电脑能取代 ChatGPT 吗?首先出现在 BeInCrypto 上。
