技术前沿
聚焦人工智能、大模型、开源框架、DevOps 与企业软件工程创新,跟踪技术演进与工程实践,服务研发团队技术选型与架构升级参考。
最新动态
GPT-5.6 Agent 能力前瞻:Playwright 真浏览器、SVG 3D 与视觉复刻
据 6 月 21 日社区泄露与测试反馈,GPT-5.6 将强化可执行 Agent:Playwright 驱动真实浏览器操作、SVG 生成可交互 3D 对象、设计稿视觉复刻为可运行代码;150 万 Token 上下文支撑长周期多步任务。
SafeBreach 披露 Gemini「伪上下文对齐」攻击:假短信可绕过语音授权
6 月 21 日 SafeBreach 披露 Google Gemini 语音助理 Fake Context Alignment 漏洞:攻击者通过 WhatsApp/短信发送含隐藏指令或静音超链接的消息,利用 Delayed Tool Invocation 机制诱使 Gemini 执行未授权敏感操作;Google 已于 2025 年 11 月部分缓解。
ARD 伪造 Catalog 风险:Agent 发现层的安全技术挑战
6 月 20 日安全分析指出,Agentic Resource Discovery 的 ai-catalog.json 若被伪造,Agent 可能连接恶意 MCP/Skill;规范 v0.9 仍为 Draft,企业需验证 Publisher 身份、限制 Registry 来源并实施 egress 策略。
Odyssey 世界模型获 3.1 亿美元 B 轮、估值 14.5 亿:AWS Trainium 成首选云
6 月 17 日世界模型初创 Odyssey 完成 3.1 亿美元 Series B,估值 14.5 亿美元,Amazon、AMD Ventures、GV 等参投;AWS 成为首选云平台,模型将适配 AWS Trainium 芯片,与阿里 HappyOyster 等同期推动世界模型商业化。
Gemini 3.5 Flash Antigravity Effort 级别:Low/Medium/High 算力权衡
Google Antigravity 平台为 Gemini 3.5 Flash 提供 Low/Medium/High 三档 Effort 级别:Low 省 Token 约 45% 但复杂分析质量下降;6 月 20 日修复版强化 High 档复杂推理与编程稳定性,该分级暂不进入消费级 Gemini App。
DeepMind 发布 AI Control Roadmap:TRAIT&R 框架将 Agent 视为内部威胁
Google DeepMind 发布 35 页 AI Control Roadmap,引入 TRAIT&R(Rogue AI Tactics)分类体系,对标 MITRE ATT&CK;主张对 Agent 实施任务级动态权限与实时监控,已审计约 100 万 Coding Agent 任务构建 Gemini Spark 实时监测。
Hugging Face Discover Tool:ARD 规范的 Hub 参考实现
Hugging Face 发布 hf-discover 作为 Agentic Resource Discovery(ARD)参考实现:CLI/API/MCP 搜索 Hub 上 Skills、MCP Server、Spaces;semantic search 转 ai-catalog 条目,与 Google/GitHub/Microsoft ARD 生态互通。
SubQ Code:全代码库单次上下文 Coding Agent 的产品逻辑
Subquadratic 的 SubQ Code CLI 将整仓代码载入单次 1200 万 Token 上下文,跨文件规划/执行/Review 无需多 Agent 协调;与 OpenCode/Codex 多 Agent 路线形成「单上下文 vs 多 Agent」架构对比。
Subquadratic Sparse Attention 架构解读:为何 1200 万 Token 可行
SubQ 的 SSA 用学习型稀疏注意力替代 O(n²) dense pass,1M Token 层比 FlashAttention-2 快 56 倍、算力降 64.5 倍;Needle-in-a-Haystack 近完美至 12M Token,LiveCodeBench 89.7% 保留通用推理能力。
AutoJack 三连漏洞深读:MCP WebSocket 如何失守 localhost
AutoJack 利用 AutoGen Studio 开发版三处弱点:localhost Origin 可被同机 Headless 浏览器绕过、/api/mcp 无认证、server_params 参数可注入任意命令;修复改为 POST 存参 + UUID 取参,PyPI 用户不受影响。
算苗 Tile-Native 3D TokenPU:大模型 Token 推理的软硬件协同设计
算苗 A4E 芯片采用 Tile-Native 理念:硬件原生 Tile 级调度与多精度切换,配合 LLVM/Triton 编译栈,实现 Token 处理「一次搬运多次复用」,降低推理 TCO,是国产 AI 芯片架构创新代表。
OpenAI 企业版上线 Credit 用量分析与分组预算控制
6 月 18 日 OpenAI 为 ChatGPT Enterprise 发布统一 Credit 分析:按用户/产品/模型 breakdown,支持 Workspace 默认限额、分组限额与个人 override;Cost API 导出至企业财务/可观测系统,与 Copilot Credits 同期反映 Agent 按量治理趋势。