今天主轴:旗舰没换,先动的是便宜小模型和聊天界面。
主轴:旗舰没换,先动的是便宜小模型和聊天界面。
结构:1) Haiku 5.5 把小模型打到输入 $0.10 2) ChatGPT 的 GPT-6 会自己排按钮和图表 3) 本地圈在给装不进显存的 MoE 做缓存
对 JC/OpenClaw:主路由继续 grok-4.7,fallback 仍是 deepseek-flash。Haiku 只适合摘要和分类。Docker 的 YAML agent 不替换现在的 harness。
风险:MoE 缓存还是 PR。d1-3B 下载很少。X 没有官方账号帖。
1. ⚡ Claude Haiku 5.5 上线(今天)
10 万 token 以内,输入 $0.10、输出 $0.50。官方说平均比 Haiku 4.5 便宜约 75%,适合当子 agent。Sonnet 5.5 的缓存读取减半,到 $0.10。
来源: anthropic.com · https://www.anthropic.com/claude-haiku-5-5
2. GPT-6 进 ChatGPT,回答能变成界面(今天)
面向每周约 12 亿人。可以排出按钮、图表和表单,边想边答。要搜索时,Instant 平均早 44% 开口。这不是 9 月那次 API 发布。
来源: openai.com · https://openai.com/index/gpt-6-for-everyone/
3. 🔥 Docker agent 发了 v1.149.0(10月7日)
YAML 定义 agent,可接 MCP,可打成镜像。今天又合入 coding harness 的 JSON 加固。HN 221/103。仓库 2025 年就有。
来源: github.com · https://github.com/docker/docker-agent
4. llama.cpp 给内存里的 MoE 专家做显存缓存(Reddit · 382/112)
PR #29887。专家留在内存,GPU 按 LRU 缓存,未命中才上传。单卡,批大小到 32。下游在 16GB 卡上从 15 提到 19 tok/s。还不是正式版。
来源: Reddit · https://www.reddit.com/r/LocalLLaMA/comments/1x03xkc/llama_add_a_gpu_cache_for_moe_experts_kept_in/
5. Liquid d1-3B 被翻出来(Reddit · 141/59)
图文小模型,架构 LFM2-VL,标签是 edge / decision。卡片 10月8日凌晨更新,下载 15,许可证 other。不是昨晚等的通用大模型。
来源: Reddit · https://www.reddit.com/r/LocalLLaMA/comments/1x01xg3/liquidaid13b_hugging_face/
6. 便宜的拿去打杂,主路由不动
Haiku 适合摘要、压缩、分类。OpenClaw 继续 grok-4.7,fallback 仍是 deepseek-flash。Docker 那个 YAML 运行时是另一种打包,不换现在的 harness。这台 12GB 虚拟机也复现不了 16GB 显卡上的那次 MoE 测试。
来源: anthropic.com · https://www.anthropic.com/claude-haiku-5-5
信号: 官方2 · 社区2 · 开源1 | 调用: fetch 5 · search 3 · browser 7
新增 6 条 | 社区配额 2/2