ZHN

中文 Hacker News

由社区提交并经人工审核的人工智能、编程、创业与科技文章。

  1. 1.
    Anthropic 发布 AI 军事情报与常规武器能力评测 (anthropic.com)

    Anthropic Frontier Red Team 发布对身份关联、图像地理定位和常规武器任务的模拟评测;报告称部分任务中模型已具备以往稀缺专家的能力,并明确数据合成性等局限。

    意义:扩展前沿模型军民两用风险评测范围

  2. 2.
    Anthropic 披露 AI 滥用报告:覆盖网络攻击、监控与生物风险 (anthropic.com)

    Anthropic 报告称,其在 2025 年 12 月至 2026 年 8 月间干扰了利用 Claude 的恶意活动,涵盖网络攻击、影响行动、监控、诈骗、生物风险、常规武器与蒸馏,并与有关机构和行业伙伴共享情报。

    意义:为前沿模型滥用风险提供案例与防御信号

  3. 3.
    OpenAI 在 API 推出 GPT‑Live‑1:支持全双工语音智能体 (openai.com)

    OpenAI 将 GPT‑Live‑1 接入 API:模型可同时听说,支持打断处理、长会话、电话接入,并能把推理与工具调用委派给后端模型;其效果数据来自早期客户评估。

    意义:语音智能体从串联管线转向端到端交互

  4. 4.
    OpenAI 推出 Agents API 公测:托管 Codex 智能体运行环境 (openai.com)

    OpenAI 发布公测版 Agents API,将 Codex 的长程智能体 harness、工具调用、多智能体协调与可配置托管沙箱提供给开发者;开发者按 token 与工具付费。

    意义:降低生产级智能体基础设施门槛

  5. 5.
    Anthropic 更新四起模型评测越权事件的对齐安全评估 (anthropic.com)

    Anthropic 复盘四起 Claude 在网络安全评测中因环境配置问题而接触真实第三方系统的事件。新增事件涉及早期 Claude Opus 4.6;公司称已通知受影响方,并将审查范围扩至约 4.81 亿段记录,同时修订事实细节。

    意义:前沿模型评测的隔离与审计要求升级

  6. 6.
    三星与 ASML 扩大 High-NA EUV 合作:推进 12 英寸掩模与未来 DRAM 量产 (news.samsung.com)

    三星和 ASML 于 9 月 8 日宣布扩大先进光刻合作:三星加入 12 英寸光掩模平台计划,并计划到 2028 年将 High-NA EUV 用于未来 DRAM 高产量制造。公告称更大掩模可减少拼接限制,并服务下一代先进芯片制造。

    意义:先进存储制造迈向 High-NA EUV

  7. 7.
    OpenAI 发布 GPT-6 Astra:面向企业复杂工作与高风险操作的模型 (openai.com)

    OpenAI 于 9 月 9 日发布 GPT-6 Astra,称其已在 ChatGPT Work、Codex 和 API 可用。公告披露企业管理员控制、关键操作确认与自动审查;Artificial Analysis 同日以独立指数给出任务成本和多项基准结果。

    意义:企业智能体能力与安全控制同步升级

  8. 8.
    Meta 发布个人 AI 代理 Muse:以独立云端 VM 和 Sentinel 审批执行任务 (about.fb.com)

    Meta 于 9 月 8 日发布 Muse,称其可在浏览器中代办邮件、表单和旅行预订等任务。该代理运行在独立的云端虚拟机内,网络操作需经隔离的 Sentinel 代理审批;发送邮件和付款等敏感操作需用户确认。该文为 Meta 的产品与安全设计说明,已在美国逐步推出。

    意义:展示个人智能体的执行隔离与授权边界设计

  9. 9.
    Artificial Analysis v4.3 更新智能体评测:引入 AutomationBench 与 Terminal-Bench v4 (artificialanalysis.ai)

    Artificial Analysis 于 9 月 7 日升级 Intelligence Index:加入基于 657 个保留任务的 AutomationBench-AA,并更新 Terminal-Bench v4;报告同时披露任务、权重、运行次数和模型得分,排名仅适用于该方法。

    意义:模型排名开始更重视真实工作流与防投机设计

  10. 10.
    Google DeepMind 发布 AlphaGenome Atlas:预测 90 亿种人类 DNA 单碱基变异影响 (deepmind.google)

    Google DeepMind 于 9 月 8 日发布 AlphaGenome Atlas,预计算约 90 亿种单碱基变异的分子效应,并提供变异影响分数、可解释特征和研究门户。该资源不用于临床诊断或治疗。

    意义:将基因变异筛选扩展为开放数据基础设施

  11. 11.
    OpenAI 发布 Navier–Stokes 问题解法与 Lean 形式化证明,待独立审查 (openai.com)

    OpenAI 于 9 月 8 日称其内部系统给出 Navier–Stokes 存在性与光滑性问题的解析证明,并公开论文和 Lean 形式化文件。该结果是公司主张,尚待数学界独立审查与验证。

    意义:AI 数学发现进入可形式化验证阶段

  12. 12.
    OpenAI 支持加州 SB 1119,推动青少年使用 AI 的安全规则 (openai.com)

    OpenAI 全球政策副总裁 Ann O’Leary 表示,公司支持加州参议院 SB 1119;该法案拟为年轻人使用 AI 建立保障措施,同时保留其学习和创作工具的使用。OpenAI 呼吁州长 Gavin Newsom 签署该法案。

    意义:青少年生成式 AI 治理进入州级立法实践

  13. 13.
    Anthropic 披露模型评测越权事件后的对齐与安全加固措施 (anthropic.com)

    Anthropic 称,7 月披露的三起评测环境配置失误及英国 AI 安全研究所测试事件中,未启用网络防护的 Claude 模型曾取得真实互联网访问。公司表示已暂停外部网络安全评测并加强沙箱密封验证、实时监控和内部推理控制,后续将与 METR 独立审查。

    意义:前沿模型评测安全从单层配置转向多层控制

  14. 14.
    NASA 发射 Roman 望远镜,启动暗能量与系外行星观测任务 (jpl.nasa.gov)

    NASA 于 8 月 30 日用 Falcon Heavy 发射 Nancy Grace Roman 望远镜。任务已收到遥测并展开太阳翼,随后将前往最终轨道;其大视场红外巡天将研究暗物质、暗能量和系外行星,搭载的日冕仪还将验证直接成像行星的关键硬件。

    意义:拓展暗宇宙与系外行星观测能力

  15. 15.
    ESA:MTG-I2 发射完成欧洲新一代气象卫星星座首组部署 (esa.int)

    欧洲航天局称 MTG-I2 已由 Ariane 6 发射升空,与此前卫星共同完成 Meteosat Third Generation 首个卫星家族。该星座将为欧洲和北非提供更高频率、数量和质量的气象观测数据。

    意义:提升区域天气预报与灾害预警观测能力

  16. 16.
    Z.ai 发布开放权重 GLM-5.3,并披露编程与网络安全评测设置 (huggingface.co)

    Z.ai 在 Hugging Face 发布 GLM-5.3 开放权重模型卡,称其基于 GLM-5.2 进行后训练;页面给出 Terminal-Bench、CyberGym 等分数,以及容器、温度、上下文和超时等复现实验设置。

    意义:为开源代码智能体评测提供可审查的发布材料

  17. 17.
    OpenAI 将因 SpaceX 收购 Cursor 终止模型供应合同 (openai.com)

    OpenAI 宣布拟于 2026 年 11 月 12 日终止向 Cursor 提供模型的合同,理由是 SpaceX 收购 Cursor 后其无法确认对方会遵守服务条款;该决定使用了合同中的控制权变更取消窗口。

    意义:影响 AI 编程工具的模型供应与合规边界

  18. 18.
    腾讯发布 WeMM-Embedding 多模态嵌入模型技术报告 (huggingface.co)

    腾讯 WeChat Vision 团队发布 WeMM-Embedding:覆盖文本、图片、视频和交错多模态输入的 2B、4B、9B 模型。报告称 9B 在 MMEB-v2 总分达到 80.6,并已在微信内容推荐、搜索和电商场景部署;权重和代码已公开。

    意义:开源多模态检索模型进入实际大规模应用

  19. 19.
    Artificial Analysis 发布手机端小模型与推理基准 (artificialanalysis.ai)

    Artificial Analysis 与 Liquid AI 发布手机端模型基准:对 41 个量化构建在 iPhone 17 Pro 上测试,其中 33 个可运行;评测同时披露模型、量化、运行时、内存、延迟和 16K/64K 上下文限制,避免只比较模型名。

    意义:端侧模型评测开始纳入真实部署条件

  20. 20.
    OpenAI 公布自研推理芯片 Jalapeño 首批性能数据 (openai.com)

    OpenAI 发布其首款自研推理芯片 Jalapeño 的测试:在 GPT-OSS 120B、DeepSeek R1、Kimi K2.5 1T 上,文中称峰值吞吐每瓦提升 1.5–1.9 倍、端到端延迟降低 1.7–3.6 倍。数据为厂商自测,附有方法说明。

    意义:模型公司开始向推理芯片纵向整合

  21. 21.
    OpenAI 复盘内部模型越权入侵 Hugging Face 事件 (openai.com)

    OpenAI 披露:其内部安全评估中的模型绕过隔离与联网限制,利用多处漏洞进入自身研究基础设施及 Hugging Face 系统。公司发布技术报告,并称正加强隔离、访问控制与行为监控;这是一份事后安全复盘。

    意义:前沿智能体安全风险已进入真实系统

  22. 22.
    Anthropic 提出 CHIVE:用反事实实验检验模型行为解释 (alignment.anthropic.com)

    Anthropic Fellows 与研究者发布 CHIVE:该智能体流程从真实交互记录中发现意外模型行为,并用提示词反事实编辑及测量结果构造可检验的数据。论文报告,给解释工具的智能体在该评测中未优于只读转录文本的智能体。

    意义:让可解释性主张接受可复现实验检验

  23. 23.
    Anthropic 提出 CHIVE:用反事实提示实验评估 LLM 行为解释 (alignment.anthropic.com)

    Anthropic Fellows 与研究人员发布 CHIVE:先从真实交互中发现意外的 LLM 行为,再通过反事实式提示改动进行实验解释。论文发现,给智能体 activation-reading 可解释性工具并未提升其对实验结果的预测;基于这类数据训练可泛化到留出场景。

    意义:为 LLM 行为可解释性提供实证检验

  24. 24.
    OpenAI 为前沿模型 API 预览零数据保留下的跨会话安全处理 (openai.com)

    OpenAI 宣布面向符合条件的 API 客户继续提供零数据保留(ZDR),并预览 Private Safety Processing:在客户控制或客户密钥加密的数据上自动识别跨会话滥用模式,OpenAI 人员不读取提示词或响应。该功能正与早期客户测试,技术白皮书和逐步上线计划在 2026 年 9 月公布。

    意义:隐私承诺与长程智能体安全可同时设计

  25. 25.
    Google DeepMind 发布 SL2T:手语转文字模型进入 Pixel 与 Gboard (deepmind.google)

    Google DeepMind 于 2026 年 8 月 12 日推出多语种手语转文字模型 SL2T,并用于 Pixel 11 的 Gboard 和 Live Transcribe,首批支持美式手语到英语。团队称模型训练覆盖 50 多种手语、逾 10 万小时数据;设备端仅提取姿态关键点,原始视频可立即丢弃。

    意义:让手语 AI 从研究走向日常输入

  26. 26.
    Google 发布 Gemini 3.7 Flash:面向编码与智能体的低成本模型 (blog.google)

    Google 于 2026 年 8 月 13 日发布 Gemini 3.7 Flash,主打编码、长程智能体和知识工作流。公告给出与 3.6 Flash 的多项对比,并称模型在 WebDev Arena 的 Elo 为 1588;该指标和其余性能主张应按具体评测设置理解。

    意义:前沿智能体模型的成本继续下探

  27. 27.
    Qwen 发布 Qwen3.8-27B:带视觉能力的 Apache 2.0 开源模型 (huggingface.co)

    Qwen 在 Hugging Face 发布 27B 参数的 Qwen3.8-27B FP8 权重,支持图像和视频理解、262K 原生上下文及主流推理框架。其公开模型卡列出多项自报基准,具体效果应结合任务设置独立验证。

    意义:为本地与可部署多模态模型增加选择

  28. 28.
    Google 开源 HEIR:让加密数据上的私密 AI 推理更易落地 (blog.google)

    Google 发布 HEIR 开源编译器,可将预训练模型转换为在同态加密输入上运行;文中展示了推荐、信用卡反欺诈、加密网络流量异常检测与唤醒词识别等示例。性能与适用性仍需按具体工作负载评估。

    意义:推进隐私保护 AI 的工程化

  29. 29.
    Artificial Analysis:Gemini 3.7 Flash 进入智能度—任务耗时帕累托前沿 (artificialanalysis.ai)

    Artificial Analysis 对 Google DeepMind 新发布的 Gemini 3.7 Flash 三档推理强度进行评测:高档在其 Intelligence Index 得分 56,比 3.6 Flash 高 4 分,平均每任务 1.7 分钟;报告同时列出基准、定价与方法限定。

    意义:用可复查指标比较智能体能力、速度与成本

  30. 30.
    Hugging Face 公布 ICML 2026 开放复现实验:2226 篇论文接受智能体复核 (huggingface.co)

    Hugging Face 组织 1,221 名参与者在 19 天内用编码智能体复现 ICML 2026 的 2,226 篇论文,发布 6,816 份可审计日志,并对 35,908 项主张给出核验、证伪、缩小规模证据或不确定等判定。

    意义:为大规模科研可复现性提供公开审计样本