Skip to content

社交媒体 AI 技术动态 — 2026-08-16

采集源:HN / r/LocalLLaMA / r/MachineLearning(r/artificial 被 rate-limit,改用 r/MachineLearning;X/Twitter 需登录,本轮未采集到) 主题:AI Agent、LLM、端侧 AI、移动端 AI

本地 LLM / 端侧

  1. Qwen 3.8 27B 发布日 Megathread — 阿里 Qwen 3.8 27B 开源发布,社区集中讨论量化、实测与部署,被视作本地旗舰模型新基准。@u/sammcj

  2. Qwen3.8-27B 一次生成 Super Mario 克隆 — 本地 27B 模型 one-shot 写出可玩的马里奥克隆,半年前难以想象,代码生成能力跃升明显。@u/MikeNonect

  3. Qwen 3.8 35B-A3B MoE 变体被发现 — Qwen 3.8 的 35B 总参 / 3B 激活 MoE 版本现身,参数效率进一步优化。@u/BazzyIm

  4. SOTA Apple Silicon Inference(2026-08-15) — 苹果芯片本地推理最新 SOTA 配置汇总,Mac 端侧部署 LLM 的实战参考。@u/McFlurriez

  5. Best Local LLMs - August 2026 — 社区整理的 8 月本地 LLM 排行榜,Qwen3.8-27B 等新模型上榜。@u/rm-rf-rm

  6. Gemma 4 E4B 量化分配带来 +140.54% 推理性能 — 张量级量化分配让 Gemma 4 E4B 推理性能暴涨,小模型端侧价值再被挖掘。@u/devildip

  7. Kimi-K3 文本模型合入 llama.cpp — 月之暗面 Kimi K3 文本模型被合入 llama.cpp,本地可跑,开源推理栈持续丰富。@u/pmttyji

AI Agent / 多智能体

  1. 新兴多智能体系统的模式与问题(Anthropic Research) — Anthropic 官方研究梳理多 Agent 系统的新兴模式与问题,Agent 架构设计必读。@Anthropic

  2. 小模型的 Agentic harness — 讨论为小模型打造的 Agent 编排框架,降低端侧/低资源 Agent 落地门槛。@u/_lhz-

LLM 能力 / 研究

  1. Survival of the Fitted:Qwen3.6 的 Jacobian lens 零微调引导 Qwen3.8 — 用 Qwen3.6 的 Jacobian lens 读取并 steer Qwen3.8,无需再训练,可解释性与模型引导新思路。@u/imstilllearningthis

  2. 把 Doom 渲染器编译进 21B 参数的 transformer — 无任何训练、将 Doom 渲染器编译成 21B transformer,权重即程序的极端案例。@u/notforrob

  3. BDH-CQ:带循环潜在推理的上下文学习 — 论文提出循环潜在推理机制强化 in-context learning,推理路径更可解释。@u/moschles

  4. AI 拥有远超人脑的工作记忆 — 文章论证 AI 的工作记忆容量远超人脑,重新审视 LLM 与人类认知的差异。@davidepiffer

工程化 / 趋势

  1. 软件工程基本功比以往更重要 — AI 辅助编码时代,工程基本功反而更关键,对转型期工程师有直接启发。@rhonabwy

  2. 美国要求盟友在中美 AI 竞赛中选边站 — 地缘政策或将影响开源模型生态与供应链,需关注后续走向。@u/johnnyApplePRNG