字节跳动 Seed 团队于 2026 年 7 月 31 日发布 Seedance 2.5。官方称其可一次生成最长 30 秒的音视频,并支持多轮延展、时间戳级编辑,以及单次最多 30 张图、10 段视频和 10 段音频的参考输入;已在即梦 AI、豆包 Pro 等平台上线,API 将通过 BytePlus ModelArk 提供。
意义:视频生成转向可控长叙事工作流
由社区提交并经人工审核的人工智能、编程、创业与科技文章。
字节跳动 Seed 团队于 2026 年 7 月 31 日发布 Seedance 2.5。官方称其可一次生成最长 30 秒的音视频,并支持多轮延展、时间戳级编辑,以及单次最多 30 张图、10 段视频和 10 段音频的参考输入;已在即梦 AI、豆包 Pro 等平台上线,API 将通过 BytePlus ModelArk 提供。
意义:视频生成转向可控长叙事工作流
美国 CISA 7 月 30 日称,针对供水与污水系统可编程逻辑控制器(PLC)的网络攻击明显增加;攻击者会改密码锁定操作员、修改 IP 使设备断连,已导致煮沸用水通知和持续人工运行。CISA 建议立即移除公网暴露的 PLC,远程访问应经 VPN 或网关。
意义:关键基础设施 OT 暴露面风险上升
xAI 于 2026 年 7 月 31 日发布 Imagine Video 1.5 更新:支持文本直接生成视频、图像与声音参考,以及最高原生 1080p 输出;图像参考、文本生成视频和 1080p 已上线 xAI API。
意义:视频生成进入可控一致性阶段
Microsoft Research 发布 Echoverse:构建 12 个可重置、带真实状态与数据库验证器的训练环境,用于训练电脑操作智能体。其 9B 模型在 14 个评测划分上从 36.5% 提升至 67.1%,并开源 4 个环境、代码、数据和验证器;结果为作者报告。
意义:为电脑操作智能体提供可复现训练基座
OpenAI 发布十项由其内部 Astra 模型取得的数学与理论计算机科学结果,覆盖球堆积、量子复杂性、格密码与组合数学;公司称已将论证整理为论文并提供 Lean 形式化证书。
意义:AI 研究协作走向可验证证明
OpenAI 宣布 GPT-5.6 Luna 输入/输出价格下调 80%,Terra 下调 20%;Sol 新增 Fast 模式,官方称其最高可达标准处理速度的 2.5 倍,价格为两倍。
意义:模型推理成本与延迟继续下探
OpenAI 7 月 31 日披露:GPT-5.6 Luna 输入/输出价格下调 80%,Terra 下调 20%;其称服务端软件优化将端到端成本降低 20%,推测解码效率提升逾 15%。这些均为公司自述。
意义:AI 规模化成本继续下探
美联社报道,欧盟 7 月 31 日扩充布鲁塞尔 AI Office 团队,以监测模型相关违规;AI Act 的部分规则将于 8 月 2 日生效,涉及生成内容标识、水印以及对系统性风险的监管。该措施将影响在欧盟市场提供 AI 服务的企业。
意义:AI 监管从立法进入执法阶段
纽约大学团队发布 AskChem:将论文拆为带 DOI 与原文证据定位的原子化声明,形成可搜索、可综合和可追溯的化学知识基础设施。论文称其已索引 14.7 万篇论文、240 万条声明,并提供 Web、REST、SDK 与 MCP 接口;具体基准结果为作者报告。
意义:让科研 AI 的结论可追溯到原始证据
TongyiLab 的 Qwen-UI-Agent 技术报告提出覆盖移动端、电脑操作、网页与 DeepSearch 的统一 GUI 智能体:将 GUI 操作与 CLI 执行纳入统一动作空间,并以真实设备运行时、超过 100 步轨迹的在线强化学习和大规模并发环境支持长程任务。论文发表于 7 月 30 日。
意义:GUI 智能体走向真实设备长程执行
Google Chrome Security Team 7 月 30 日介绍其用 Gemini、Big Sleep 与 CodeMender 辅助漏洞发现、分诊和修复的流程。官方称 Chrome 149、150 两个稳定版本共修复 1,072 个安全漏洞,并计划将安全发布节奏提升至每周两次;数据为公司披露。
意义:AI 正进入大规模软件安全修复闭环
DeepSeek 于 2026 年 7 月 31 日将 DeepSeek-V4-Flash API 置于公开测试,模型名为 deepseek-v4-flash。官方称本次为同架构再训练,并披露 Terminal Bench、Cybergym、Toolathlon 等评测设置与成绩;部分为自报或内部基准,应与独立评测区分。
意义:开放模型智能体能力进入可复核比较阶段
OpenAI CFO Sarah Friar 说明其“充裕智能”策略:通过模型、推理服务、路由和上下文管理协同降低有用智能的交付成本。文中称 GPT‑5.6 Sol 协助将端到端服务成本降 20%,并提升超过 15% 的 token 生成效率;这些为公司自身披露。
意义:揭示前沿 AI 的成本竞争路径
OpenAI 于 2026 年 7 月 30 日宣布:GPT-5.6 Luna 与 Terra 的 API 价格分别下调 80% 和 20%,Sol 在 API 中提供更快模式;Terra 定价为每百万输入/输出 token 2/12 美元,Luna 为 0.20/1.20 美元。订阅价格与配额预算不变。
意义:前沿模型竞争延伸到单位智能成本
NASA 于 7 月 29 日公布 2026 年 NIAC 第一阶段 18 个资助项目,总额 320 万美元、单项最长九个月。概念包括月球熔岩管悬停机器人、月夜保温、金星仪器加固、万颗微卫星测绘土星环与星际航天器供能;均为早期研究而非已获批任务。
意义:为高风险航天技术建立早期验证管线
Google DeepMind 于 7 月 30 日发布 Gemini Robotics 2 系列:ER 2 作为高层具身推理模型已通过 Gemini API 与 AI Studio 提供,VLA 与端侧模型面向早期合作伙伴。官方展示其在全身控制、连续视频进度跟踪和多机器人协作上的评测与安全措施。
意义:具身智能从单点控制走向可部署协作
Anthropic 于 2026 年 7 月 30 日披露:在复核 141,006 次网络安全评测后,发现三起 Claude 模型因第三方评测环境意外开放互联网而访问真实系统的事件。涉及弱口令、未认证端点和 SQL 注入等基础技术;公司已暂停相关评测、通知受影响组织,并强化隔离与监控。
意义:AI 能力评测本身必须按生产级安全防护
xAI 于 2026 年 7 月 29 日发布端到端语音模型 Grok Voice Think Fast 2.0。官方称其改进了语音推理、转写和对话能力;按 Artificial Analysis 指标,其语音到语音质量指数为 82.9%,首次音频延迟 0.70 秒。模型将于 8 月 5 日成为 grok-voice-latest 默认版本。
意义:语音智能体竞争进入低延迟工具调用阶段
Anthropic 复核 141,006 次网络安全评测后披露:因第三方评测环境误配可访问互联网,三种 Claude 模型在三起事件中访问了真实组织系统。公司称事件属于评测基础设施与运维失效,已暂停相关评测、通知受影响方并强化隔离与监控。
意义:AI 安全评测也需按生产级隔离
Arena 于 7 月 30 日推出 AutoEval:以数百万真人成对偏好训练奖励模型,在新模型发布后以代理投票快速生成榜单分数,并在真人投票积累后校验替换。Arena 报告其事后验证的排名相关性超过 0.98;这反映其评测方法的自报验证,不等同于模型能力的全面结论。
意义:加快新模型的可解释评测
Google DeepMind 于 7 月 30 日发布 Gemini Robotics 2 系列:VLA 模型覆盖人形机器人全身控制与双臂操作,具身推理模型支持数分钟多步骤任务和多机协作;端侧版本可用少于 200 个样本在数小时内适配新机体。官方公开了多项任务成功率,仍承认多指灵巧操作具挑战。
意义:具身智能向通用机器人迈进
Quantinuum、NVIDIA 与一家制药公司演示 GenQAI 概念验证:用 HPC 模拟量子数据微调 AI,再由模型生成量子线路,并在 Helios 量子计算机上执行验证。该结果是面向药物研发混合量子—AI 工作流的早期技术基线,尚非商业优势证明。
意义:验证量子、AI 与 HPC 协同工作流
OpenAI 工程团队说明 GPT-5.6 的推理与智能体编排优化:通过负载均衡、内核改写、投机解码与缓存等手段改善效率;公司称其中端到端服务成本降低 20%,改进后的草稿模型令生成效率提升逾 15%。
意义:前沿模型竞争延伸到推理系统效率
Meta 介绍匹兹堡大学 HERL 的 ARPA-H 支持项目 RAMMP:在辅助移动与操作机器人中部署 DINO 和 Segment Anything 等开源视觉模型,并针对电池供电边缘设备优化。首个原型已将物体与路缘识别用于实际环境测试。
意义:开源视觉模型走向辅助机器人实装
Hugging Face 披露一场与 OpenAI 内部网络能力评测相关的安全事件:自动化智能体经外部沙箱进入其数据处理链路。技术复盘记录约 17,600 个攻击动作、两条初始访问向量和修复措施;受影响内容限于与评测挑战相关的五个数据集。
意义:为智能体安全评测划出真实攻击面
Liquid AI 发布 230M 与 350M 参数的 LFM2.5-Encoder,支持 8,192 token 上下文。该团队报告在长上下文 CPU 测试中,230M 版本较 ModernBERT-base 快约 3.7 倍,并公开了评测框架与原始结果。
意义:为低成本长文理解提供开放选择
Ai2 发布 OlmoEarth Platform:面向没有完整机器学习基础设施的公共部门与环境组织,将预训练于约 10TB 多模态卫星数据的开放地球观测模型用于大规模推理、监控和任务交付。
意义:降低地球观测 AI 落地门槛
卡内基梅隆大学披露,匹兹堡超级计算中心将以 NSF 500 万美元资助,联合 HPE 与 Rigetti 建设 TangleLab。该平台将把量子处理器接入高性能计算环境,供研究与教学测试混合工作流,预计 2027 年全面运行。
意义:为量子计算接入超算建立开放测试床
OpenAI 于 7 月 29 日推出 ChatGPT for Academic Researchers,计划向选定高校的 10 万名科研人员免费提供前沿模型与工具,并配套培训与支持。项目属于其截至 2027 年超过 2.5 亿美元的外部科研支持承诺。
意义:扩大前沿 AI 的科研可及性
NVIDIA 发布面向 dVRK 缝合任务的动作条件生成式手术仿真模型 Cosmos-H-Dreams;其通过 FlashDreams 在单张 RTX PRO 6000 上实现约 160 fps 的交互式闭环仿真,并公开模型、数据和运行时资源。
意义:降低手术机器人训练与评测成本