今天主轴:本地算力被写成新 Mac mini 的卖点,同时有人证明模型输出可以当宿主机 exploit。
主轴:硬件把「跑大模型」塞进桌面,攻击面已经打到推理引擎的 token 解析。
结构:1) Apple 今日发布 M6 / M5 Ultra,Mac mini 第一次用上 2nm Dual Neural Engine 2) Qwen3.8-Flash-Next 预告明日开源,HN 写成 125B-A6B 3) HN 169↑ 讲 vLLM 曾对 tool-call 参数 eval(),恶意 token 能控宿主机
对 JC/OpenClaw:主会话继续 grok-4.6。Mac mini 换代是硬件新闻,不是换一层 harness。缺的仍是 permission/terminate,外加「模型输出只当数据、禁止进 eval/parser」。别为等 Flash-Next 去装日榜。
风险:Flash-Next 还是倒计时,125B 数字来自 HN 标题未官宣锁死;vLLM CVE-2025-9141 是已修案例,论点是解析面还在;Apple 数字是自家跑分。
1. ⚡ Qwen3.8-Flash-Next 预告明日开源(今日)
ModelScope 上架倒计时;HN 写成 125B-A6B 多模态 MoE,定位 Qwen4 架构预热。
来源: modelscope.cn · https://modelscope.cn/models/Qwen/Qwen3.8-Flash-Next
2. ⚡ Apple M6 / M5 Ultra:桌面 AI 算力换代(今日)
M6 进新 Mac mini(2nm、双 16 核 Neural Engine、170GB/s);M5 Ultra 1.2TB/s 跑大模型。
来源: apple.com · https://www.apple.com/newsroom/2026/08/apple-introduces-m6-and-m5-ultra-for-a-big-leap-in-performance-and-ai-compute/
3. 🔥 模型输出可打穿推理引擎、控制宿主机(8/24)
论点:恶意 token 利用 vLLM/SGLang 解析面;vLLM 曾对 Qwen3 Coder tool-call 做 eval()(CVE-2025-9141)。
来源: boydkane.com · https://boydkane.com/essays/llms-could-control-their-host-machines-by-exploiting-inference-engines
4. HN:Apple M6 / M5 Ultra 桌面 AI 换代(131↑ / 63评 · 今日)
热度在「Mac mini 本地跑大模型」和带宽数字,不是新 harness。
来源: news.ycombinator.com · https://news.ycombinator.com/item?id=49433292
5. HN:LLM 能靠推理引擎漏洞控宿主机(169↑ / 83评 · 8/24)
社区在对 vLLM 解析/eval 历史打补丁,焦点是 agent 输出当代码。
来源: news.ycombinator.com · https://news.ycombinator.com/item?id=49424387
6. 别把模型 token 喂进未沙箱的 parser
JC 的 Mac mini 就算换成 M6,也解决不了「输出被当成指令」。OpenClaw 继续 grok-4.6;工具参数只反序列化、不 eval。Flash-Next 明天再看卡,不预装。
来源: boydkane.com · https://boydkane.com/essays/llms-could-control-their-host-machines-by-exploiting-inference-engines
信号: 官方2 · 社区2 · 开源1 | 调用: fetch 6 · search 8 · browser 8
新增 6 条 | 社区配额 2/2
降级: hn/front 适配器缺失→hackernews/top;Reddit JSON 超时;X 无一线账号;GitHub Trending web_fetch 超时(curl 有榜但未单列)