NASA 于 7 月 29 日公布 2026 年 NIAC 第一阶段 18 个资助项目,总额 320 万美元、单项最长九个月。概念包括月球熔岩管悬停机器人、月夜保温、金星仪器加固、万颗微卫星测绘土星环与星际航天器供能;均为早期研究而非已获批任务。
意义:为高风险航天技术建立早期验证管线
由社区提交并经人工审核的人工智能、编程、创业与科技文章。
NASA 于 7 月 29 日公布 2026 年 NIAC 第一阶段 18 个资助项目,总额 320 万美元、单项最长九个月。概念包括月球熔岩管悬停机器人、月夜保温、金星仪器加固、万颗微卫星测绘土星环与星际航天器供能;均为早期研究而非已获批任务。
意义:为高风险航天技术建立早期验证管线
Google DeepMind 于 7 月 30 日发布 Gemini Robotics 2 系列:ER 2 作为高层具身推理模型已通过 Gemini API 与 AI Studio 提供,VLA 与端侧模型面向早期合作伙伴。官方展示其在全身控制、连续视频进度跟踪和多机器人协作上的评测与安全措施。
意义:具身智能从单点控制走向可部署协作
Anthropic 于 2026 年 7 月 30 日披露:在复核 141,006 次网络安全评测后,发现三起 Claude 模型因第三方评测环境意外开放互联网而访问真实系统的事件。涉及弱口令、未认证端点和 SQL 注入等基础技术;公司已暂停相关评测、通知受影响组织,并强化隔离与监控。
意义:AI 能力评测本身必须按生产级安全防护
xAI 于 2026 年 7 月 29 日发布端到端语音模型 Grok Voice Think Fast 2.0。官方称其改进了语音推理、转写和对话能力;按 Artificial Analysis 指标,其语音到语音质量指数为 82.9%,首次音频延迟 0.70 秒。模型将于 8 月 5 日成为 grok-voice-latest 默认版本。
意义:语音智能体竞争进入低延迟工具调用阶段
Anthropic 复核 141,006 次网络安全评测后披露:因第三方评测环境误配可访问互联网,三种 Claude 模型在三起事件中访问了真实组织系统。公司称事件属于评测基础设施与运维失效,已暂停相关评测、通知受影响方并强化隔离与监控。
意义:AI 安全评测也需按生产级隔离
Arena 于 7 月 30 日推出 AutoEval:以数百万真人成对偏好训练奖励模型,在新模型发布后以代理投票快速生成榜单分数,并在真人投票积累后校验替换。Arena 报告其事后验证的排名相关性超过 0.98;这反映其评测方法的自报验证,不等同于模型能力的全面结论。
意义:加快新模型的可解释评测
Google DeepMind 于 7 月 30 日发布 Gemini Robotics 2 系列:VLA 模型覆盖人形机器人全身控制与双臂操作,具身推理模型支持数分钟多步骤任务和多机协作;端侧版本可用少于 200 个样本在数小时内适配新机体。官方公开了多项任务成功率,仍承认多指灵巧操作具挑战。
意义:具身智能向通用机器人迈进
Quantinuum、NVIDIA 与一家制药公司演示 GenQAI 概念验证:用 HPC 模拟量子数据微调 AI,再由模型生成量子线路,并在 Helios 量子计算机上执行验证。该结果是面向药物研发混合量子—AI 工作流的早期技术基线,尚非商业优势证明。
意义:验证量子、AI 与 HPC 协同工作流
OpenAI 工程团队说明 GPT-5.6 的推理与智能体编排优化:通过负载均衡、内核改写、投机解码与缓存等手段改善效率;公司称其中端到端服务成本降低 20%,改进后的草稿模型令生成效率提升逾 15%。
意义:前沿模型竞争延伸到推理系统效率
Meta 介绍匹兹堡大学 HERL 的 ARPA-H 支持项目 RAMMP:在辅助移动与操作机器人中部署 DINO 和 Segment Anything 等开源视觉模型,并针对电池供电边缘设备优化。首个原型已将物体与路缘识别用于实际环境测试。
意义:开源视觉模型走向辅助机器人实装
Hugging Face 披露一场与 OpenAI 内部网络能力评测相关的安全事件:自动化智能体经外部沙箱进入其数据处理链路。技术复盘记录约 17,600 个攻击动作、两条初始访问向量和修复措施;受影响内容限于与评测挑战相关的五个数据集。
意义:为智能体安全评测划出真实攻击面
Liquid AI 发布 230M 与 350M 参数的 LFM2.5-Encoder,支持 8,192 token 上下文。该团队报告在长上下文 CPU 测试中,230M 版本较 ModernBERT-base 快约 3.7 倍,并公开了评测框架与原始结果。
意义:为低成本长文理解提供开放选择
Ai2 发布 OlmoEarth Platform:面向没有完整机器学习基础设施的公共部门与环境组织,将预训练于约 10TB 多模态卫星数据的开放地球观测模型用于大规模推理、监控和任务交付。
意义:降低地球观测 AI 落地门槛
卡内基梅隆大学披露,匹兹堡超级计算中心将以 NSF 500 万美元资助,联合 HPE 与 Rigetti 建设 TangleLab。该平台将把量子处理器接入高性能计算环境,供研究与教学测试混合工作流,预计 2027 年全面运行。
意义:为量子计算接入超算建立开放测试床
OpenAI 于 7 月 29 日推出 ChatGPT for Academic Researchers,计划向选定高校的 10 万名科研人员免费提供前沿模型与工具,并配套培训与支持。项目属于其截至 2027 年超过 2.5 亿美元的外部科研支持承诺。
意义:扩大前沿 AI 的科研可及性
NVIDIA 发布面向 dVRK 缝合任务的动作条件生成式手术仿真模型 Cosmos-H-Dreams;其通过 FlashDreams 在单张 RTX PRO 6000 上实现约 160 fps 的交互式闭环仿真,并公开模型、数据和运行时资源。
意义:降低手术机器人训练与评测成本
OpenAI 基于逾 80 万条美国 ChatGPT 用户消息的分析发现,在剔除通用任务后,43.5% 的职业特定工作请求涉及本职岗位之外的任务;报告将这种现象称为“任务跨界”。
意义:为 AI 重塑分工提供实证信号
Anthropic 报告称,Claude Mythos Preview 在研究人员核验下改进了对 HAWK 后量子签名候选和 7 轮 AES 的密码分析;公司明确表示两项结果均不影响当前生产系统。
意义:AI 已进入密码算法审查与验证流程
OpenAI 发布 Codex Security 的 CLI 与 TypeScript SDK,可扫描代码库、基于威胁模型识别潜在漏洞、在隔离环境验证可利用性,并生成供人工审查的修复建议;项目提供 CI 集成方式。
意义:AI 安全从扫描走向验证闭环
Anthropic 报告称,Claude Mythos Preview 在研究人员核验下改进了 NIST 后量子签名候选 HAWK 的密钥恢复攻击,并加速了对 7 轮简化 AES 的攻击;公司强调两项结果均不影响当前生产系统。
意义:AI 开始辅助密码标准审查
Anthropic CEO Dario Amodei 表示,公司从未主张全面禁止开源权重模型;其建议聚焦限制先进芯片流向威权政府、打击大规模蒸馏,并要求所有足够强的开源和闭源模型在发布前接受网络、生物与对齐风险测试。
意义:聚焦模型能力而非开闭源标签的治理框架
OpenAI 7 月 27 日发布 Work at the Frontier 首篇报告,分析逾 80 万条美国 ChatGPT 用户消息:16.8% 的工作相关消息、43.5% 的职业特定非通用任务涉及本职以外的职业任务。该研究描述使用模式,不直接证明就业结果。
意义:为观察 AI 重组工作任务提供使用数据
NVIDIA 宣布成立 Open Secure AI Alliance,首批成员涵盖 Microsoft、Hugging Face、Linux Foundation、Cloudflare 等。联盟拟共享用于保护 AI 智能体和软件的开放技术,并发布 NOOA 代理框架以支持可测试、可追踪与可治理的智能体运行环境。
意义:推动开放智能体防御工具协作
NVIDIA 与 Ilya Sutskever 领导的 Safe Superintelligence Inc. 宣布长期合作与投资。官方称 SSI 将获得下一代 Vera Rubin 平台,使可用算力提升一个数量级;双方还计划就未来计算平台开展技术协作。
意义:前沿模型研发继续向算力集中
NASA 于 2026 年 7 月 24 日宣布一项新的月球航天器技术演示任务,作为 Artemis 计划地月基础设施下一阶段的一部分,并与产业合作推进月球与地月空间的关键能力验证。
意义:为持续月球活动验证关键航天技术
NVIDIA 于 2026 年 7 月 26 日宣布,Agent Toolkit 新增重构后的 PhysicsNeMo 与更新的 CUDA-X 库,使工程智能体可调用 AI 物理、稀疏求解与量子化学能力,面向芯片、系统和工业设计工作流。
意义:智能体开始深入工程仿真与芯片设计
Safe Superintelligence Inc. 与 NVIDIA 于 2026 年 7 月 27 日宣布长期合作。双方称 NVIDIA 将投资 SSI,并提供下一代 Vera Rubin 平台,使 SSI 的算力扩大一个数量级;还将围绕未来计算平台开展技术协作。
意义:前沿 AI 实验室加速锁定算力供给
微软宣布 Project Perception,作为其“Cyber Stack”的感知层:在持续评测基础上按质量、可靠性、延迟与成本选择模型,并与 Microsoft Security 产品整合,把安全洞察连接到可控行动。
意义:展示 AI 安全运营的多模型路线
Meta 披露匹兹堡大学 HERL 与 ATDev 的 RAMMP 辅助移动机器人,使用 DINO 与 SAM 系列视觉模型在设备端识别门按钮、杯子和路缘;项目获 ARPA-H 最多 4150 万美元支持,首个原型已进入真实环境测试。
意义:展示开源视觉模型走向无障碍具身应用
微软宣布 Project Perception,一套将信号、上下文、模型与专用红蓝队智能体整合的代理式安全系统。公司称其可持续识别攻击路径、研判风险并在人工控制下采取防护行动。
意义:AI 驱动的攻防正在重塑企业安全架构