聚合展示与「大模型」相关的 站点内容 :资讯动态、产品与解决方案等,一站浏览。
6 月 19 日 Miami 初创 Subquadratic 公布 Appen 独立测试:稀疏注意力 LLM SubQ 在 LiveCodeBench 达 89.7%,比 FlashAttention 快 56 倍;RULER 128 测试成本 $8 vs Opus 4.6 约 $2600,支持 1200 万 Token 上下文。
6 月 18 日 Anthropic 国际董事 Chris Ciauri 在首尔记者会称对 Fable 5/Mythos 5 恢复「非常有信心将在未来几天内可用」;系美方出口管制指令后首次给出近端时间信号,与白宫磋商进行中。
6 月 12–13 日美国商务部要求 Anthropic 限制外国国民访问 Fable 5/Mythos 5,Anthropic 全球停服;6 月 18 日前后 Dario Amodei 与白宫磋商,公司正开发国籍身份验证系统,预计 7 月恢复符合条件用户访问,企业需评估出口合规与备用模型。
沙泽尔从 Google Gemini 加盟 OpenAI,发生在 GLM-5.2 MIT 开源与美国限制 Anthropic 模型对外访问同一窗口期;各国「主权 AI」与人才流动政策将深刻影响企业模型选型与本地化部署策略。
6 月 18 日,谷歌工程副总裁、Gemini 模型联合负责人诺姆·沙泽尔(Noam Shazeer)宣布离职并将加入 OpenAI。沙泽尔是 Transformer 论文作者之一,曾创立 Character.AI 后回归谷歌,此次流动再度搅动全球大模型人才与竞争格局。
6 月 17–18 日 OpenAI 推出新一代实时语音模型 GPT-Realtime-2 与 GPT-Realtime-Whisper,面向低延迟语音 Agent、客服与多模态应用;与 ChatGPT 默认模型升级 GPT-5.5 Instant 同期,强化语音交互赛道。
6 月 17 日 OpenAI 公布与 Molecule.one 合作:GPT-5.4 连接 Maria 高通量化学实验室 Agent,自主设计实验优化 Chan-Lam 偶联反应,88% 底物产率提升,人类化学家 bench 规模验证 11/14 成功。
6 月 17 日阿里发布世界模型产品 HappyOyster 1.0(快乐生蚝),支持 Adventure 探索与 Directing 实时导演,一句话/一张图生成可交互 AI 数字世界;联合南京大学打造行业评测基准,面向游戏、文旅、虚拟陪伴等场景。
GLM-5.2 采用 MIT 协议全量开放权重,与 Anthropic 出口管制停服形成对照;企业可将 MIT 开源模型纳入地缘政治断供 Fallback 清单,但须同步评估权重血缘与国产算力适配合规。
GLM-5.2 采用 IndexShare 架构,在 100 万 Token 上下文下将单位 Token FLOPs 降至约 2.9×;升级 MTP 层提升投机解码效率,解决长文本 Coding Agent 训练环境扩展与性能退化问题。
Devstral 2 为 123B 密集 Transformer,256K 上下文,针对代码 Agent 优化;Small 2 为 24B 可消费级 GPU 本地部署。本文拆解其 SWE-bench 评测含义、与 Claude Sonnet 差距及 Vibe CLI 工具链。
Mistral 发布 Devstral 2(123B)与 Devstral Small 2(24B),SWE-bench Verified 分别达 72.2% 与 68.0%,并推出 Apache 2.0 终端 Agent「Mistral Vibe CLI」,API 现阶段免费。
6月17日,智谱 AI(Z.ai)正式开源 GLM-5.2 旗舰模型,753B 总参数/40B 激活、MIT 协议、100 万 Token 无损上下文;FrontierSWE 74.4 分逼近 Opus 4.8,Code Arena 开源模型全球第二。
6月17日 Chatbot Arena 更新榜单,智谱 GLM-5.2 (Max) 升至第 10 位(GLM 5.1 此前第 13,DeepSeek-V4 Pro 第 14)。在 Anthropic 断供与微软探索开源替代背景下,榜单变化影响企业模型选型。
openPangu 2.0 采用自研 MoE 超稀疏架构,512K 注意力模块、昇腾专属算子与鸿蒙端侧适配工程将随 6 月 30 日开源批次发布;Pro/Flash 双版本覆盖云到端全栈部署。
HDC 2026 发布的 openPangu 2.0 为国内首款昇腾全链路千亿级开源 MoE 大模型,512K 超长上下文;官方宣布 6 月 30 日起分批开源七大核心组件,含权重、预训练源码与鸿蒙端侧适配。
快手开源 Keye-VL-2.0-30B-A3B,30B 总参数/3B 激活,首次将 DeepSeek Sparse Attention 适配 GQA 多模态架构,256K 上下文;LongVideoBench 74.1 超 Qwen3-VL-235B,Apache 2.0 许可。
Fable 5 全球停服后,Anthropic 已派高级技术人员赴华盛顿与白宫官员会晤,辩称政府所引越狱风险被夸大且 GPT-5.5 存在同类问题;模型能否恢复取决于出口管制分类谈判结果。
Fable 5 / Mythos 5 因美国出口管制令全球停服后,Anthropic 6月16日宣布面向受影响用户开启退款服务,截止 6 月 20 日 23:59;传亚马逊曾向商务部演示越狱方法触发禁令。
即便权重来源存争议,Rio 3.5 Open 397B 在模型卡上公布的 SwiReasoning、MoE 17B 激活、多模态与多语言配置仍代表 2026 年超大规模开源模型的一种工程范式,值得技术团队拆解评估。
共 113 条 · 每页 20 条