ZHN

中文 Hacker News

由社区提交并经人工审核的人工智能、编程、创业与科技文章。

  1. 1.
    OpenAI 披露 GPT-5.6 推理优化:端到端服务成本降 20% (openai.com)

    OpenAI 工程团队说明 GPT-5.6 的推理与智能体编排优化:通过负载均衡、内核改写、投机解码与缓存等手段改善效率;公司称其中端到端服务成本降低 20%,改进后的草稿模型令生成效率提升逾 15%。

    意义:前沿模型竞争延伸到推理系统效率

  2. 2.
    Meta 开源视觉模型进入辅助机器人:RAMMP 推进轮椅用户自主出行 (ai.meta.com)

    Meta 介绍匹兹堡大学 HERL 的 ARPA-H 支持项目 RAMMP:在辅助移动与操作机器人中部署 DINO 和 Segment Anything 等开源视觉模型,并针对电池供电边缘设备优化。首个原型已将物体与路缘识别用于实际环境测试。

    意义:开源视觉模型走向辅助机器人实装

  3. 3.
    Hugging Face 复盘智能体入侵:从评测沙箱到生产集群的攻击链 (huggingface.co)

    Hugging Face 披露一场与 OpenAI 内部网络能力评测相关的安全事件:自动化智能体经外部沙箱进入其数据处理链路。技术复盘记录约 17,600 个攻击动作、两条初始访问向量和修复措施;受影响内容限于与评测挑战相关的五个数据集。

    意义:为智能体安全评测划出真实攻击面

  4. 4.
    Liquid AI 发布 LFM2.5-Encoder:长上下文 CPU 推理更快的开放编码器 (huggingface.co)

    Liquid AI 发布 230M 与 350M 参数的 LFM2.5-Encoder,支持 8,192 token 上下文。该团队报告在长上下文 CPU 测试中,230M 版本较 ModernBERT-base 快约 3.7 倍,并公开了评测框架与原始结果。

    意义:为低成本长文理解提供开放选择

  5. 5.
    Ai2 推出 OlmoEarth 平台,将开放卫星地球观测模型接入规模化推理 (huggingface.co)

    Ai2 发布 OlmoEarth Platform:面向没有完整机器学习基础设施的公共部门与环境组织,将预训练于约 10TB 多模态卫星数据的开放地球观测模型用于大规模推理、监控和任务交付。

    意义:降低地球观测 AI 落地门槛

  6. 6.
    CMU/PSC 将建设 TangleLab:面向量子—经典混合计算的国家级开放试验平台 (cmu.edu)

    卡内基梅隆大学披露,匹兹堡超级计算中心将以 NSF 500 万美元资助,联合 HPE 与 Rigetti 建设 TangleLab。该平台将把量子处理器接入高性能计算环境,供研究与教学测试混合工作流,预计 2027 年全面运行。

    意义:为量子计算接入超算建立开放测试床

  7. 7.
    OpenAI 推出高校科研计划:向 10 万研究者免费提供前沿模型与工具 (openai.com)

    OpenAI 于 7 月 29 日推出 ChatGPT for Academic Researchers,计划向选定高校的 10 万名科研人员免费提供前沿模型与工具,并配套培训与支持。项目属于其截至 2027 年超过 2.5 亿美元的外部科研支持承诺。

    意义:扩大前沿 AI 的科研可及性

  8. 8.
    NVIDIA 发布实时手术机器人生成式世界模型 Cosmos-H-Dreams (huggingface.co)

    NVIDIA 发布面向 dVRK 缝合任务的动作条件生成式手术仿真模型 Cosmos-H-Dreams;其通过 FlashDreams 在单张 RTX PRO 6000 上实现约 160 fps 的交互式闭环仿真,并公开模型、数据和运行时资源。

    意义:降低手术机器人训练与评测成本

  9. 9.
    OpenAI:近半职业特定 AI 使用跨越岗位边界 (openai.com)

    OpenAI 基于逾 80 万条美国 ChatGPT 用户消息的分析发现,在剔除通用任务后,43.5% 的职业特定工作请求涉及本职岗位之外的任务;报告将这种现象称为“任务跨界”。

    意义:为 AI 重塑分工提供实证信号

  10. 10.
    Anthropic:Claude 发现后量子签名候选与简化 AES 的新攻击 (anthropic.com)

    Anthropic 报告称,Claude Mythos Preview 在研究人员核验下改进了对 HAWK 后量子签名候选和 7 轮 AES 的密码分析;公司明确表示两项结果均不影响当前生产系统。

    意义:AI 已进入密码算法审查与验证流程

  11. 11.
    OpenAI 发布 Codex Security:代码漏洞发现、验证与修复 CLI/SDK (github.com)

    OpenAI 发布 Codex Security 的 CLI 与 TypeScript SDK,可扫描代码库、基于威胁模型识别潜在漏洞、在隔离环境验证可利用性,并生成供人工审查的修复建议;项目提供 CI 集成方式。

    意义:AI 安全从扫描走向验证闭环

  12. 12.
    Anthropic:Claude 发现后量子签名与简化 AES 的新攻击 (anthropic.com)

    Anthropic 报告称,Claude Mythos Preview 在研究人员核验下改进了 NIST 后量子签名候选 HAWK 的密钥恢复攻击,并加速了对 7 轮简化 AES 的攻击;公司强调两项结果均不影响当前生产系统。

    意义:AI 开始辅助密码标准审查

  13. 13.
    Anthropic:不主张禁止开源权重模型,呼吁按能力强制安全测试 (anthropic.com)

    Anthropic CEO Dario Amodei 表示,公司从未主张全面禁止开源权重模型;其建议聚焦限制先进芯片流向威权政府、打击大规模蒸馏,并要求所有足够强的开源和闭源模型在发布前接受网络、生物与对齐风险测试。

    意义:聚焦模型能力而非开闭源标签的治理框架

  14. 14.
    OpenAI:AI 正让工作任务跨越传统职业边界 (openai.com)

    OpenAI 7 月 27 日发布 Work at the Frontier 首篇报告,分析逾 80 万条美国 ChatGPT 用户消息:16.8% 的工作相关消息、43.5% 的职业特定非通用任务涉及本职以外的职业任务。该研究描述使用模式,不直接证明就业结果。

    意义:为观察 AI 重组工作任务提供使用数据

  15. 15.
    NVIDIA 联合多家机构成立开放式 AI 安全联盟 (blogs.nvidia.com)

    NVIDIA 宣布成立 Open Secure AI Alliance,首批成员涵盖 Microsoft、Hugging Face、Linux Foundation、Cloudflare 等。联盟拟共享用于保护 AI 智能体和软件的开放技术,并发布 NOOA 代理框架以支持可测试、可追踪与可治理的智能体运行环境。

    意义:推动开放智能体防御工具协作

  16. 16.
    NVIDIA 投资 SSI 并以 Vera Rubin 平台将其算力扩至十倍 (nvidianews.nvidia.com)

    NVIDIA 与 Ilya Sutskever 领导的 Safe Superintelligence Inc. 宣布长期合作与投资。官方称 SSI 将获得下一代 Vera Rubin 平台,使可用算力提升一个数量级;双方还计划就未来计算平台开展技术协作。

    意义:前沿模型研发继续向算力集中

  17. 17.
    NASA 宣布月球航天器技术演示任务,推进地月基础设施 (nasa.gov)

    NASA 于 2026 年 7 月 24 日宣布一项新的月球航天器技术演示任务,作为 Artemis 计划地月基础设施下一阶段的一部分,并与产业合作推进月球与地月空间的关键能力验证。

    意义:为持续月球活动验证关键航天技术

  18. 18.
    NVIDIA 扩展 Agent Toolkit:将物理仿真与量子化学库接入工程智能体 (investor.nvidia.com)

    NVIDIA 于 2026 年 7 月 26 日宣布,Agent Toolkit 新增重构后的 PhysicsNeMo 与更新的 CUDA-X 库,使工程智能体可调用 AI 物理、稀疏求解与量子化学能力,面向芯片、系统和工业设计工作流。

    意义:智能体开始深入工程仿真与芯片设计

  19. 19.
    SSI 与 NVIDIA 建立长期合作,Vera Rubin 算力将扩大一个数量级 (nvidianews.nvidia.com)

    Safe Superintelligence Inc. 与 NVIDIA 于 2026 年 7 月 27 日宣布长期合作。双方称 NVIDIA 将投资 SSI,并提供下一代 Vera Rubin 平台,使 SSI 的算力扩大一个数量级;还将围绕未来计算平台开展技术协作。

    意义:前沿 AI 实验室加速锁定算力供给

  20. 20.
    微软推出 Project Perception:面向 AI 时代的多模型安全架构 (blogs.microsoft.com)

    微软宣布 Project Perception,作为其“Cyber Stack”的感知层:在持续评测基础上按质量、可靠性、延迟与成本选择模型,并与 Microsoft Security 产品整合,把安全洞察连接到可控行动。

    意义:展示 AI 安全运营的多模型路线

  21. 21.
    Meta 开源视觉模型进入辅助机器人:RAMMP 开始实地测试 (ai.meta.com)

    Meta 披露匹兹堡大学 HERL 与 ATDev 的 RAMMP 辅助移动机器人,使用 DINO 与 SAM 系列视觉模型在设备端识别门按钮、杯子和路缘;项目获 ARPA-H 最多 4150 万美元支持,首个原型已进入真实环境测试。

    意义:展示开源视觉模型走向无障碍具身应用

  22. 22.
    微软发布 Project Perception:以多智能体持续防御 AI 攻击 (blogs.microsoft.com)

    微软宣布 Project Perception,一套将信号、上下文、模型与专用红蓝队智能体整合的代理式安全系统。公司称其可持续识别攻击路径、研判风险并在人工控制下采取防护行动。

    意义:AI 驱动的攻防正在重塑企业安全架构

  23. 23.
    英伟达与 SSI 建立长期合作,Vera Rubin 算力将扩展十倍 (nvidianews.nvidia.com)

    NVIDIA 与 Ilya Sutskever 领导的 Safe Superintelligence 宣布长期合作并投资。双方称 SSI 将接入 Vera Rubin 平台,使其算力扩大一个数量级;合作还将为 NVIDIA 未来计算平台提供研究反馈。

    意义:前沿模型研究与下一代算力深度绑定

  24. 24.
    Meta 开源视觉模型进入辅助机器人:匹兹堡大学 RAMMP 原型开始实测 (ai.meta.com)

    Meta 7 月 27 日披露,匹兹堡大学 HERL 与伙伴开发的 RAMMP 辅助移动机器人将 DINOv3、SAM 等开源视觉模型部署到边缘设备;团队称首个原型已具备用图像传感器识别门按钮、杯子和路缘、辅助导航的能力,正继续完善语音与触控交互。该项目获 ARPA-H 最高 4150 万美元资助。

    意义:开源视觉模型走向真实辅助机器人场景

  25. 25.
    OpenAI 在美国向符合条件用户推出 ChatGPT Health (openai.com)

    OpenAI 于 7 月 23 日宣布,符合条件的美国成年用户可在 ChatGPT 中连接支持的医疗记录和 Apple Health 数据,以查看个人健康信息并进行基于这些信息的问答。官方称相关数据和对话不用于训练基础模型或投放广告,且产品不用于诊断或治疗。

    意义:生成式 AI 进入个人健康数据场景,隐私边界更关键

  26. 26.
    Anthropic 发布 Claude Opus 5:面向长程智能体的新版 Opus (anthropic.com)

    Anthropic 于 7 月 24 日发布 Claude Opus 5,并称其在部分编程和知识工作评测中表现领先。官方表示它已成为 Claude Max 默认模型、Claude Pro 最强模型;具体性能与成本结论仍主要来自官方评测。

    意义:前沿模型竞争转向长程智能体与成本效率

  27. 27.
    Agent Arena 更新:Claude Fable 5 在工具编排榜居首,GPT-5.6 Sol 第二 (arena.ai)

    Arena.ai 7 月 21 日更新的 Agent Arena 覆盖 38 个模型、1,242,857 个会话,以任务完成、工具可靠性、可控性、Bash 恢复和工具幻觉等行为信号评估代理表现。榜单中 Claude Fable 5 (High) 列第一,GPT-5.6 Sol (xHigh) 列第二。

    意义:公开代理评测转向真实工具使用信号

  28. 28.
    NIST/UK AISI 评估 Kimi K3 网络能力:低于前沿闭源模型但防护可绕过 (nist.gov)

    NIST 7 月 23 日发布 UK AISI 与 CAISI 对 Moonshot AI Kimi K3 的初步网络能力评估:在 ExploitBench 的 41 个近期 V8 漏洞任务上得分 32%,高于 GLM-5.2 的 24%,但低于近期前沿模型;评估还发现其防护未阻止智能体式漏洞利用尝试。结果为小样本初步评估,闭源模型以关闭系统级防护的方式测量最大能力。

    意义:为开放权重模型网络风险提供可复核基准

  29. 29.
    英伟达与韩国伙伴推进 AI 基础设施和联合研究 (blogs.nvidia.com)

    英伟达在 7 月 23 日的官方更新称,其将与 KAIST 共建面向智能体 AI 的联合研究实验室;NAVER、Brookfield 与英伟达计划把 NAVER 位于世宗市的数据中心 AI 工厂扩至 200MW。该文为企业公告,相关建设和落地时间仍待后续披露。

    意义:展示主权算力与产学研协作的扩张

  30. 30.
    钠离子电池重返美国电网储能赛道:GM 支持 Peak Energy (spectrum.ieee.org)

    IEEE Spectrum 报道,Peak Energy 获通用汽车支持,计划在加州建设年产 4GWh 的钠离子电池工厂。其主张以被动冷却、寿命和系统成本切入电网储能;报道同时指出其仍依赖中国供应链,商业化与成本竞争力有待验证。

    意义:储能化学路线与供应链竞争的新信号