聚合展示与「AI智能体」相关的 站点内容 :资讯动态、产品与解决方案等,一站浏览。
Sysdig 7/1 披露首例 LLM 端到端驱动勒索:利用 Langflow RCE,31 秒内自适应修正认证错误;横向移动至 MySQL+Nacos 生产库;AES 密钥 ephemeral 不可恢复;Base64 Python 经 Langflow 端点投递。
Sonnet 5 在推理、工具使用、编码、知识工作全面提升;Anthropic 6/30 更正 BrowseComp 评测方法论后仍维持成本-性能优势叙事;提高 Chat/Cowork/Code 速率限制适配高 effort 模式;安全栈针对 Agent 劫持场景加固。
6 月 30 日 Anthropic 发布 Claude Sonnet 5,主打自主规划、浏览器/终端工具调用;性能接近 Opus 4.8 但价格更低,API 限时 $2/$10 per M Token(8/31 前),之后 $3/$15;成 Free/Pro 默认模型,Agent 编码评测 63.2% 超 Sonnet 4.6 的 58.1%。
Claude Science 整合数据库、分析流水线、文献工具于单一工作台;不引入专用模型或额外 gating;与 GPT-Rosalind 微调路线对比为 workflow-first;支持生物医药等领域可重复研究流程。
6 月 30 日新加坡 Acti 发布 iOS/Android Agent 键盘,长按字母触发翻译、会议链接等 Skills;用户自然语言描述即可创建 Skill,两周内测超 1000 个;Gemini 提供多语言与成本平衡;BITKRAFT 领投 530 万美元种子轮。
6 月 30 日 Anthropic 发布 Claude Science beta,为科学家提供统一计算研究环境,运行现有 Opus 4.8 等模型无特殊门槛;对标 OpenAI GPT-Rosalind 生物推理路线,诺和诺德、Allen Institute 为案例客户;开放 50 个项目最高 3 万美元额度申请至 7/15。
Patronus 为模型厂商与企业构建可编程数字环境,Agent 在仿真世界中完成任务后被评分;与 Scaled Cognition 从模型侧、Coval 从语音侧形成三角互补;收入 15 倍增长验证企业采购意愿。
6 月 25 日 Patronus AI 完成 5000 万美元 Series B,Greenfield 领投,累计 7000 万;前 Meta AI 研究员创立,收入一年增长 15 倍,用仿真数字环境在 Agent 触达真实系统前完成评测。
General Intuition 通过 Medal 游戏录制平台获取大规模人类操作数据,训练 Large Action Foundation Models;与 Brianna Martin 首席幕僚称 Medal 曾拒绝大型 lab 收购要约;CoreWeave 算力合作支撑下一代预训练。
6 月 25 日 General Intuition 完成 3.2 亿美元 Series A,估值 23 亿美元,Khosla 领投;通过 Medal 平台人类行为数据训练大动作基础模型与世界模型,资金主要用于 CoreWeave 算力扩容,夏末开放 API。
APT 非简单 frontier 套壳,而是独立研发路径结合 LLM 优势;平台含模型、Agent 工具、仿真评测与在线监控;Genesys Cloud 集成实现客服场景 policy-following 虚拟坐席;Khosla 称「Agent 真动作场景只有可靠才 counts」。
6 月 25 日 Scaled Cognition 完成 1 亿美元 Series A,Khosla 领投,估值约 7.5 亿美元;APT 模型已在金融/医疗/电信/保险 Fortune 500 生产部署,Genesys 参投并用于客服 Agent 虚拟坐席。
收购后 TrueFoundry 在客户既有 K8s 基础设施上叠加 AI Gateway(路由/限流/PII)与 Seldon Core 模型服务,形成从传统 ML 到 Agentic AI 的统一入口;日万亿 Token 网关 + 金融级实时推理治理。
6 月 24 日企业 AI 基础设施 TrueFoundry 收购英国 MLOps 厂商 Seldon AI(2014 年成立,服务金融/医疗/零售),整合后 AI Gateway 日处理超万亿 Token,提供从 ML 推理到 Agentic AI 的 Kubernetes 原生命令中心,对抗 AWS/Azure/GCP 捆绑工具。
Coval 平台对 AI 语音/聊天 Agent 做仿真、观测与标注:概率评测覆盖数百万交互场景,上线前后全生命周期;Waymo 背景团队将「仿真先行」引入 Agent QA,支持 Zoom 等大规模语音部署。
Coval A 轮反映语音 AI 进入生产阶段后 reliability/compliance 成硬约束;金融/医疗/客服场景需录音留存、意图审计与概率评测;欧盟 AI Act 高风险分类与 TCPA/ HIPAA 等美国行业规则叠加;企业须建立上线前仿真+上线后监控双轨治理。
6 月 24 日语音 AI 评测初创 Coval 完成 2800 万美元 Series A,Norwest 领投,累计 3100 万;平台对数百万语音交互做概率评测,客户称 QA 工作量降 30 倍、部署提速 10 倍;2026 Q1 语音 AI 融资超 7 亿美元,2031 市场预计超 200 亿。
豆包专业版办公任务模式技术路径:用户给出目标 → 2.1 Pro 自主规划 → 调用本地 OS/浏览器/飞书/自定义 Skills → 产出可交付文档/表格/PPT/全栈网站;免费版 Turbo 模型提供同等流程低额度体验,形成 2 亿用户反馈飞轮。
6 月 24 日豆包上线专业版,首个 Agent 驱动办公任务模式搭载豆包 2.1 Pro,可自主拆解步骤、操作本地电脑与浏览器、调用 Skills 与飞书套件,交付报告/PPT/网站等成品;三档订阅 68/200/500 元/月,免费版可用 Turbo 模型体验。
Runlayer 针对 Model Context Protocol 提供企业级网关:发现/鉴权 MCP 服务器、重建 Agent Intent、传统 APM 无法处理的非确定性 trace;与 Microsoft Agent 365 等竞争中立控制平面定位。
共 217 条 · 每页 20 条