技术动态 - 2026-07-31¶
AI & 大模型¶
-
首个突破90%成功率的桌面操作智能体!实在Agent登顶OSWorld双冠 — 国产桌面操作Agent以90.2%总成功率包揽OSWorld总榜与Agentic Framework分榜双冠,标志着桌面Agent从"堆模型"进入"拼工程"阶段。
-
从GPT-2到Kimi K3:七年规模扩大2.26万倍,大模型架构主线是在建立一套"记忆操作系统" — 深入分析大模型七年演进,核心架构本质上是在构建一套越来越强的记忆操作系统,而非单纯追求参数增长。
-
OpenAI宣布降价:GPT-5.6 Luna降80%,Terra降20%,Sol推出快速模式 — OpenAI大幅下调API调用价格,Luna降幅达80%,同时推出Sol快速模式,AI推理成本竞争进一步加剧。
-
Google DeepMind发布Gemini Robotics 2,瞄准通用机器人控制 — DeepMind推出新一代机器人控制模型,目标实现跨场景通用操作能力,标志着具身智能进入新阶段。
-
腾讯混元开源 AngelSpec 框架 — 投机解码框架全链路开源,包含drafter训练工具、Hy3-A21B的MTP/DFly权重与训练代码,加速大模型推理。
-
xAI 发布 Grok Voice Think Fast2.0 — 新一代语音识别模型,在智能水平、转录准确率、对话能力和工具调用效率方面全面升级,面向语音Agent开发者。
-
317 家 AI 独角兽,超过一半从来没发过论文 — 斯坦福研究揭示:AI独角兽普遍停止发表研究成果,超半数从未发表同行评审论文,OpenAI贡献了近四成引用量。
Agent & 架构¶
-
Kubernetes 统治了容器时代,谷歌 Agent Substrate 意在拿下下一个十年 — 谷歌认为K8s不适合做AI Agent控制平面,推出Agent Substrate新方案,试图在Agent时代复制K8s的成功。
-
深度访谈|第二次权力转移:当Agent拿走数据库的行动权 — Agent正在重新定义数据库的角色:从"数据存储"到"行动权分配中枢",这是继云原生之后的第二次权力转移。
-
用于生产安全运维的多智能体 AI:5G 核心网中的 A2A 和 MCP 架构 — 基于一级电信运营商5G核心网的生产级实践,多Agent层通过A2A协议协调,MCP与环境集成,已在真实运维中持续优化一年。
-
OpenSandbox:重新思考 Agent 时代的 Runtime — Agent时代需要全新的Runtime设计,OpenSandbox提出了安全、可扩展的沙箱方案。
-
Skills vs MCP: How AI tools have evolved — Google AI团队分析Skills和MCP两种AI工具扩展范式的演进路径,对比各自优劣与适用场景。
编程 & 开源¶
-
React Compiler 迁移 Rust 后更快了,但开发者担心"没人看得懂代码" — Meta将React Compiler从JS移植至Rust,构建性能大幅提升,但社区担忧Rust门槛影响开源贡献。
-
GitLab 19.2 借助 AI 代理处理安全待办事项 — GitLab新版本引入AI代理自动化处理因AI编码工具导致的代码审查和安全扫描积压。
-
GCC 宣布 AI 政策:拒绝包含 LLM 生成内容的代码贡献 — GCC指导委员会正式采纳AI贡献政策,禁止接受含LLM生成内容的具有版权意义的代码贡献(约15行以上)。
-
Visual Studio Code 1.131 发布 — 增强subagents可见性、内置语音输入功能、新增混合Markdown编辑器,AI编码体验持续演进。
采集时间:2026-07-31 10:06 CST | 来源:InfoQ、OSCHINA、Dev.to、Solidot