技术前沿
聚焦人工智能、大模型、开源框架、DevOps 与企业软件工程创新,跟踪技术演进与工程实践,服务研发团队技术选型与架构升级参考。
最新动态
谷歌第八代 TPU 架构解读:8t 训练 + 8i 推理分离,Agent 成本降 3 倍
Cloud Next 2026 发布的 TPU v8 首次将训练(TPU 8t)与推理(TPU 8i)拆分为专用芯片,性能约为上一代 3 倍,目标降低 Agent 长时运行与大规模推理的 TCO,挑战 NVIDIA GPU 在推理侧的主导地位。
Vercel eve 技术深读:Filesystem-first 与 Durable Execution 如何支撑长时 Agent
eve 采用 filesystem-first 设计:Agent 即目录(agent.ts + instructions.md),持久化执行基于开放 adapter,支持运行数小时/数天/数周;集成 Sandbox、审批流与任意 MCP,解决「Demo Agent 无法上生产」痛点。
Databricks Genie ZeroOps:内置数据平台的自治运维 Agent
Genie ZeroOps 是 Databricks 内置的后台 Agent,利用 Unity Catalog 血缘、指标/日志/事件与 Shallow Clone 沙箱,自主监控管道/作业/表/ML 模型并提议修复;解决「Coding Agent 能建不能运维」痛点。
ASR(AI Software Runtime)开源:Builder-Tester-Analyzer 收敛循环
ASR 是基于多 Agent 协作的自动化软件工程运行时,通过 Builder→Tester→Analyzer 闭环从 DESIGN.md 生成并收敛代码直至测试全过;作者以 GLM-4.7-FP8 等低成本模型验证「收敛运行时」可逼近更强模型效果。
Databricks Agent Bricks 平台化:10 万+ Agent、年处理 1 千万亿 Token
DAIS 2026 上 Databricks 将 Agent Bricks 升级为完整开发者 Agent 平台,支持任意模型/Harness、任意数据源、安全 Sandbox 与 Agent Memory;AstraZeneca、7-Eleven 等已投产。
GLM-5.2 IndexShare 架构解读:1M 上下文 Token FLOPs 降至 2.9×
GLM-5.2 采用 IndexShare 架构,在 100 万 Token 上下文下将单位 Token FLOPs 降至约 2.9×;升级 MTP 层提升投机解码效率,解决长文本 Coding Agent 训练环境扩展与性能退化问题。
Devstral 2 技术解读:256K 上下文下的 SWE-bench 72.2% 如何实现
Devstral 2 为 123B 密集 Transformer,256K 上下文,针对代码 Agent 优化;Small 2 为 24B 可消费级 GPU 本地部署。本文拆解其 SWE-bench 评测含义、与 Claude Sonnet 差距及 Vibe CLI 工具链。
OpenSkill:无目标监督的开放世界 Agent 自进化框架
Salesforce 与 Lehigh 等团队发布 OpenSkill,Agent 仅凭任务提示从文档/仓库/网页构建技能与自验证信号,无需目标任务监督;在三个基准上取得最佳自动化通过率,技能可跨模型迁移。
清华博士开源 COMPASS 司南:任务森林 + 用户画像的 Agent 技能中间层
6月16日,清华 dongshuyan 开源 COMPASS 司南——面向科研与编程的个性化 Agent 技能系统,支持需求前置对齐、任务 DAG/森林可视化、本地化可审计用户画像,npx 一键安装,适配 Codex 与 Claude Code。
openPangu 2.0 架构深读:512K 稀疏注意力 × 昇腾算子 × 鸿蒙端侧
openPangu 2.0 采用自研 MoE 超稀疏架构,512K 注意力模块、昇腾专属算子与鸿蒙端侧适配工程将随 6 月 30 日开源批次发布;Pro/Flash 双版本覆盖云到端全栈部署。
OpenClaw v2026.6.8 发布:Gateway 运行时加固与 Agent 会话治理升级
6月16日 OpenClaw 发布 v2026.6.8,改进 Agent/Cron/Gateway 运行时:主会话 abort 处理、子 Agent 并行控制、WebChat 轨迹导出、HTTP 会话覆盖面权限收紧,并升级 Hono 依赖修复安全漏洞。
快手 Keye-VL-2.0:256K 长视频 MoE 多模态 Agent,LongVideoBench 74.1
快手开源 Keye-VL-2.0-30B-A3B,30B 总参数/3B 激活,首次将 DeepSeek Sparse Attention 适配 GQA 多模态架构,256K 上下文;LongVideoBench 74.1 超 Qwen3-VL-235B,Apache 2.0 许可。