Tech Shots
AI与机器人快讯
中文

AI与机器人快讯 – 页码 3

2026年9月9日周三
工具

OpenAI设立500万美元青少年AI研究资助

OpenAI于2026年9月8日宣布设立一项500万美元的资助计划,支持关于生成式AI如何影响13至17岁青少年的独立研究,单项资助最高100万美元,重点关注社交与情感发展、安全保障和适龄设计。申请开放至2026年10月6日,入选提案将在11月13日前获得通知;资助资金由OpenAI Group PBC提供。

工具

Copilot可批量修复Code Quality发现的问题

GitHub于2026年9月9日宣布,智能体自动修复现在可以批量处理GitHub Code Quality的标准发现:在一页上最多选择25项发现,一次性指派给Copilot,Copilot会以智能体方式在分支上修复,验证其更改,然后创建拉取请求供审核。对单个发现,“指派给Copilot”取代了“生成修复”,沿用现有的Code Quality企业策略(没有单独策略),并消耗AI积分;启用Code Quality后,GitHub Team和Enterprise Cloud(含数据驻留)均可使用。

模型

AlphaGenome Atlas绘制90亿个DNA变异图谱

Google DeepMind于2026年9月8日推出AlphaGenome Atlas,这是一个约1PB的数据库,收录了AlphaGenome对人类基因组中每一种可能的单核苷酸变化(约90亿个变异)的预先计算预测。它新增了AlphaGenome Variant Impact(AVI)评分,融合AlphaGenome与AlphaMissense的信号,帮助研究人员更快地对编码和非编码变异排序,同时提供无代码网页门户、AlphaGenome API和Antigravity技能;非商业访问现已开放,Google Cloud上的商业使用计划很快推出。

模型

ChatGPT Images 2.5:更清晰、更快的图像模型

OpenAI于2026年9月8日发布ChatGPT Images 2.5,这是一款新的图像模型,细节更清晰、生成更快、多轮编辑更精确,新增Sketch(@ Sketch)绘图、Poster和Merch等创意模板,并支持发布图像时可选择分享提示词。该模型正陆续向各档位的ChatGPT、ChatGPT Work和Codex用户推出,覆盖桌面、移动端和网页;API新增GPT-Image-2.5 Flare(侧重速度)和GPT-Image-2.5 Sunburst(更高精度、更长运行)。OpenAI称其对参考照片的还原度更高,并为更高的真实感更新了安全体系。

工具

Meta在美国推出个人AI智能体Muse

Meta于2026年9月8日表示,推出个人AI智能体Muse,它不只回答问题,还能代表用户完成任务和更长期的目标。Muse由Muse Spark驱动,运行在Muse Secure VM上——这是一台专用云虚拟机,拥有独立浏览器,并设有单独的Sentinel关口管控对外操作。用户可通过Muse应用或WhatsApp向它发消息,并选择它可访问的应用;在发送邮件或购物等敏感步骤前,Muse会先征求确认,结账可使用带一次性卡片的Link by Stripe。该产品将在美国通过iOS、Android和muse.ai推出(AI眼镜随后支持),大多数使用免费,较重的工作需付费套餐。

模型

OpenAI模型提出纳维–斯托克斯千禧年难题解答

OpenAI于2026年9月8日表示,一个能力超过GPT-6 Astra的内部系统给出了纳维–斯托克斯方程解的存在性与光滑性这一千禧年大奖难题的解答:初始光滑且静止的流体在光滑外力作用下,可在能量保持有限的同时于有限时间内产生奇点,从而证明了克雷研究所的命题C和D。该公司发布了说明文章,以及经GPT-6 Astra验证的Lean形式化证明,期间进行了约88小时的多智能体搜索和17小时的形式化,并表示无意申领千禧年大奖。OpenAI提到Levent Alpöge与Tristan Buckmaster同时期关于受迫欧拉方程的工作,承认他们在该结果上的优先权,并将此次发布定位为AI研究速度的证据,而非消费级产品发布。

2026年9月6日周日
模型

OpenAI发表《An Alien Mind》,呼吁警惕递归自我改进

OpenAI于2026年9月6日发表《An Alien Mind》,这是首席科学家Jakub Pachocki撰写的安全/研究文章。文章依据内部结果认为,当前能力提升的速度可能延续到递归自我改进(RSI),未来的系统将越来越多地主导自身的开发。Pachocki写道,这需要极度谨慎,OpenAI将继续推进对齐、监测和防御系统,并可能在必要时单方面暂缓进一步扩展规模,同时仍需要更广泛的干预措施;他还转述了OpenAI的说法,即GPT-6 Astra的对齐程度明显优于GPT-5.6 Sol,并强调随着模型能力增强,还需要更多的对齐进展。他认为没有任何实验室已把对齐和监测解决到足以继续以最高速度扩展很久的程度,并呼吁在形成共同的安全标准和国际协调之前自愿放缓。

模型

OpenAI达成“自动化研究实习生”目标

OpenAI于2026年9月6日表示,按其自身测量,已在9月前实现去年秋天提出的“自动化研究实习生”目标:该系统能在人类指导下完成定义明确的研究任务,包括熟练研究员需要几天才能完成的工作,并称正朝着2028年3月前实现自动化AI研究员稳步推进。研究报告称,编码智能体正在重塑研究人员的工作日:到8月中旬,研究员的中位数每天使用的推理按API价格计超过600美元,第90百分位超过每天7000美元,每个人类工作日对应约3.1个智能体工作日;同时强调优先级仍由人类设定,且尚不清楚完全对齐的递归自我改进是否安全。

工具

OpenAI Daybreak:10亿美元支持一线网络防御者

OpenAI于2026年9月3日表示,推出“Daybreak for Frontline Defenders”,这是一项全球倡议,承诺投入10亿美元,为资源有限的网络防御者提供补贴的Daybreak访问权限、培训、技术支持和合作,目标是在未来六个月内用完,先从美国开始,并在未来几周扩展到合作伙伴国家。该方案包括“Daybreak for America”(优先面向供水与污水处理、电网、州和地方政府、社区银行、非营利组织和开源维护者)、与MS-ISAC合作的公共部门和供水试点,以及Daybreak Defense Network中的35多个合作伙伴产品;Daybreak Blue使用主线模型进行常规防御,Daybreak Red则为经审核的组织增加专门的网络安全模型(OpenAI称在2000个获批工作区中有数千名防御者)。

模型

Microsoft AI推出语音识别模型MAI-Transcribe-2

Microsoft AI于2026年9月3日表示,MAI-Transcribe-2可在Microsoft Foundry、MAI Playground和Open Router中试用。该公司称,模型新增说话人分离、词级时间戳、关键词偏置、逐字/整洁两种风格以及语码转换,并声称在60种语言的FLEURS评测中排名第一(平均WER为5.2%),同时位于Artificial Analysis准确率—延迟帕累托前沿;这些排名是Microsoft在发文时的引述。发布价格为每小时音频0.10美元,持续到年底。

模型

Microsoft向Foundry开发者开放MAI-Image-2.6

Microsoft AI于2026年9月4日表示,MAI-Image-2.6及其速度更快的同系列模型MAI-Image-2.6-Flash已在Microsoft Foundry和MAI Playground向开发者开放。两款模型都新增了多参考图编辑、网页接地和动态宽高比(最高约1.5K);Microsoft称Flash生成图像的速度约为GPT-Image-2-Medium的2.8倍,且效率更高。文中引用的Arena和Artificial Analysis排名是Microsoft在该日期的自行引述。

模型

Lyria 3.5登陆Gemini应用和API

Google于2026年9月4日表示,音质最佳的音乐生成模型Lyria 3.5已在Gemini应用和Gemini API中上线,人声更具表现力,编曲更丰富。在Gemini应用中,用户可以选择或描述曲风,选择人声或纯器乐,使用新模板,并选择较短或较长的曲目;网页端和移动端全球可用。艺术家和AI创作者还可在Google Flow Music中使用,开发者则可通过Google AI Studio和Google Vids使用。

工具

GPT-6 Astra现已登陆GitHub Copilot

GitHub于2026年9月4日表示,OpenAI的GPT-6 Astra已在GitHub Copilot正式发布(GA),面向Pro+、Max、Business和Enterprise用户,覆盖VS Code、Visual Studio、CLI、编码智能体、Copilot应用、github.com、移动端、JetBrains、Xcode和Eclipse(逐步推出)。在GitHub内部测试中,它的突出之处在于边工作边规划和验证,长程编码能力更强,在Copilot中比此前的OpenAI模型所需步骤更少。它在按用量计费下按供应商标价收费;Business/Enterprise管理员通过Copilot模型策略管理访问(除非关闭了全局默认启用或屏蔽了该模型,否则新模型默认开启)。

工具

GitHub将于10月2日停用旧版Copilot模型

GitHub于2026年9月3日表示,将在2026年10月2日于所有GitHub Copilot体验中弃用Gemini 3.5 Flash、Gemini 3.6 Flash、Kimi K2.7 Code和Claude Opus 4.7,并建议用户改用Gemini 3.8 Flash、Kimi K3和Claude Opus 5。Business和Enterprise管理员可能需要在Copilot模型策略中启用替代模型。

2026年9月5日周六
模型

OpenAI在ChatGPT和API推出GPT-6 Astra

OpenAI于2026年9月3日推出GPT-6 Astra,称其为在计算机操作、编程、网络安全、科学和专业工作方面能力最强的模型。发布先面向有限的一批组织,未来几天将覆盖ChatGPT Plus、Pro、Business和Enterprise,以及OpenAI API、Microsoft Azure和AWS Bedrock(模型ID为gpt-6-astra;标准API价格为每百万输入/输出token 10美元/50美元)。OpenAI称,Astra在FrontierMath Tier 4上达到98%、ARC-AGI-3上达到99.9%、ExploitBench上达到100%,已使这些基准饱和;在更强保障措施下达到其Preparedness Framework的“关键”网络安全门槛,并计划在未来几周为更广泛的防御性网络工作流提供Daybreak访问;Enterprise版Astra在发布时默认关闭。

2026年9月4日周五
工具

Gemini 3.8 Flash登陆GitHub Copilot

GitHub于9月3日表示,Google的Gemini 3.8 Flash已在Copilot上线,面向Pro、Pro+、Max、Business和Enterprise用户,覆盖VS Code、Visual Studio、CLI、云端智能体、Copilot应用、JetBrains、Xcode和Eclipse(逐步推出)。在GitHub的早期测试中,它在复杂的终端编程和从可处理的失败中恢复方面表现良好。在Business/Enterprise中,除非管理员关闭了全局默认启用或该模型,否则新模型默认开启;供应商的推出期价格持续到2026年12月31日。

2026年9月3日周四
模型

Google绘制出雄性果蝇完整大脑图谱

2026年9月3日,Google Research、HHMI Janelia及合作者发布了首张成年雄性果蝇大脑和中枢神经系统的完整连接图谱,包含超过16.6万个神经元和11,691种细胞类型。AI将数百万张二维切片拼接成三维神经元形态;该图谱继此前完整的雌性果蝇连接组之后发布,旨在成为公共神经科学资源。同日发布的三项配套研究将其应用于视觉、味觉和社会行为。这是连接组学研究,并非Gemini产品。

工具

NVIDIA:RTX Spark PC十月上市,并推出本地PAIR路由器

NVIDIA在IFA 2026上表示,RTX Spark Windows PC将于10月上市,包括全新的联想Yoga Pro 9n和Yoga 9n二合一设计,以及宏碁的紧凑型台式机;该超级芯片集成1 petaflop的RTX Blackwell GPU、最高128GB统一内存和20核Grace CPU。NVIDIA还发布了PAIR的免费开源测试版,这是一款Personal AI Router,可将推理分散到本地网络中闲置的PC上(支持Ollama和LM Studio;Windows、macOS和Linux)。llama.cpp和vLLM的新优化使本地吞吐量最高提升1.9倍,Hermes Agent、OpenClaw和Perplexity Portable Computer在NVIDIA硬件上的本地部署也将更简单——这里指的是RTX Spark,而不是Meta的Muse Spark或xAI的Grok。

模型

WeatherNext 3:5公里分辨率的逐小时全球预报

Google DeepMind和Google Research推出WeatherNext 3,这是一个每小时重新初始化、并直接接入实时地球静止轨道卫星拼接图像的全球天气模型;Google称其为迄今最准确的全球天气模型,并引用Brightband的独立实时评估。它以5公里分辨率解析温度和湿度,以10公里解析其他地表变量,以25公里解析大气变量,比WeatherNext 2的25公里、六小时一次的网格清晰约五倍,并新增100米风、云量和辐射,用于可再生能源规划。从今天起,它开始为Google搜索、Gemini应用、地图、Google Maps Platform Weather API和Earth Engine提供支持,提前一天或更久的降水预报准确率最高提升50%;数据可在BigQuery和Earth Engine中查询,或从Cloud Storage下载。

商业

NVIDIA将以129.3亿美元收购Hugging Face

NVIDIA于2026年9月3日表示,已同意以12,930,300,000美元收购Hugging Face,相关文章由首席执行官黄仁勋署名。NVIDIA称平台将保持开放:开发者仍可自行选择模型、框架、云和推理提供商,通过Hugging Face构建或部署无需使用NVIDIA算力。文章称该平台拥有超过1800万用户、300多万个模型、50万个数据集和20万家公司,并表示NVIDIA是其最大的开放模型和数据贡献者。

模型

Meta发布面向智能体和编程的Muse Spark 1.3

Meta AI Research于2026年9月2日发布Muse Spark 1.3,智能体和编程性能更强,正陆续在Muse Code和Meta Model API中推出。此次更新改进了更长周期的工作流、在杂乱对话串中的多任务处理以及编程效率(Meta工程师称与1.2相比,工具调用约减少20%,token约减少25%)。推理模式现已提供,最大推理将在更多安全测试后推出。

工具

使用Copilot的企业可将任意模型设为默认

自2026年9月2日起,GitHub允许企业管理员通过托管设置,选择任意偏好的Copilot模型作为新对话的默认模型。当模型键被标记为可覆盖并更新team-mappings.json后,各团队可以拥有自己的默认模型;其他所有人继承企业默认设置。该功能已面向Copilot Business和Copilot Enterprise在Copilot应用、Copilot CLI和Visual Studio Code中正式发布(GA)。

工具

Copilot 应用和 CLI 现已遵循内容排除设置

GitHub 自 2026 年 9 月 2 日起,在 Copilot 应用和 Copilot CLI 中正式推出内容排除策略。由企业、组织或仓库管理员设置的排除规则,会让所列文件在各类智能体工作流中不进入 Copilot 的上下文。此项变更适用于 Copilot Business 和 Copilot Enterprise;这里指的是 GitHub Copilot,而不是 Microsoft 365 Copilot。

模型

谷歌通过 Fairwind 推出 Gemini 3.8 Flash Cyber

Google DeepMind 推出面向防御方的 Gemini 3.8 Flash Cyber 模型,用于发现漏洞和自动修补,仅通过新的 Fairwind 计划向受信任的合作伙伴开放。Fairwind 将 Flash Cyber 与谷歌的 CodeMender 框架结合,让政府和企业防御人员能在其安全的云环境内发现、验证并修复缺陷。与面向智能体、已全面开放的 Gemini 3.8 Flash 不同,Flash Cyber 为限量开放;这里指的是 Gemini 模型,而非加密货币交易所。

工具

NVIDIA 与 CrowdStrike 推出智能体网络安全栈 SafeMind

在 Fal.Con 2026 上,NVIDIA 和 CrowdStrike 发布了智能体网络安全系统 SafeMind,其防御模型基于 NVIDIA Nemotron 构建,并使用 CrowdStrike 的威胁数据进行后训练。CrowdStrike 称,Blue Solano(基于 Nemotron 3 Super)在内部评测中以低得多的成本超过了领先的前沿模型;SafeMind 原生集成于 Falcon,并可选择通过 QuiltWorks 访问这些模型。

2026年9月2日周三
模型

Google Research 推出用于多变量预测的 TimesFM-3

Google Research 推出 TimesFM-3,这是一个拥有 3.3 亿参数的时间序列基础模型,在超过一万亿个时间点上预训练,用于零样本多变量预测。它能在一次前向传播中联合预测相关序列,并结合过去和已知未来的协变量,在 Gift-Eval、FEV-Bench 和 Time 上位居预训练基础模型前列。权重以非商业许可发布在 GitHub 和 Hugging Face,BigQuery 集成即将推出。这里指的是 TimesFM,既不是 Gemini,也不是加密货币交易所。

工具

NVIDIA 发布面向机器人的 Jetson Orin Nano 2

NVIDIA 发布了入门级机器人计算机 Jetson Orin Nano 2,在与上一代 Nano 相同的尺寸下推理性能翻倍,在 15 瓦模式下同等性能功耗降低 40%。它面向机器人、无人机和视觉系统,配备 78 TOPS 算力、8GB 内存和 8 核 Arm CPU。模块和开发者套件预计 2027 年上半年推出,目前尚未上市。

工具

NVIDIA 将 Groq 3 LPX 推理加速器投入量产

NVIDIA 表示,其交互式推理加速器 Groq 3 LPX 作为 Vera Rubin 的扩展产品已全面投产。该公司称,在 10 万 token 上下文下,Gemma 4 31B 的输出速度达到每秒 3,400 个 token,是 Artificial Analysis 基准测试中最接近的替代方案的四倍。

模型

DeepMind 推出面向智能体工作的 Gemini 3.8 Flash

Google DeepMind 将 Gemini 3.8 Flash 列为正式可用:这是其迄今最智能的 Flash 主力模型,面向编程和智能体,支持 100 万输入和 6.4 万输出 token。它可在 Gemini 应用、Gemini API、Google AI Studio、Antigravity、Gemini AI 模式和 Gemini Enterprise Agent Platform 中使用。DeepMind 称其在长周期软件工程和智能体基准上超过 3.7 Flash,其中 HLE-Verified 得分为 54.9%;这里指的是 Gemini 模型,而非加密货币交易所。

工具

Visual Studio 中的 GitHub Copilot 新增思考力度控制

GitHub 在 Visual Studio 中为受支持的模型新增了低、中、高三档思考力度控制,并在选择器中加入组织级自定义智能体。用户可以固定模型、查看上下文窗口和成本,还能在提交 PR 前让 Git 智能体审查未提交的更改,包括 Azure DevOps 仓库。所有 Copilot 套餐(包括 Free)均可使用。

工具

Power Apps 画布应用创作智能体插件正式发布

微软于 9 月 1 日正式推出与智能体共同创作画布应用的功能:创作者和编码智能体通过基于 MCP 的插件共享同一创作模型,该插件可创建屏幕、连接连接器、编写 Power Fx,并与实时会话同步。产出仍是普通画布应用,沿用现有的连接器、治理和部署方式;为管理 token,你可以自行选择哪些交给智能体、哪些手动编辑。

工具

OpenAI 支持加州青少年 AI 安全法案 SB 1119

8 月 31 日,OpenAI 表示支持加州参议院第 1119 号法案,该法案为青少年设定符合年龄的 AI 保护措施,同时保留教育用途的使用权限。公司列出其支持的要求:年龄判定、发布前风险评估、独立审计、针对高风险内容的保护、家长工具、危机资源链接,以及对 13 至 17 岁用户自动实施的定向广告限制。OpenAI 将该法案与 ChatGPT for Teens 的默认设置联系起来,并呼吁州长纽森签署。

工具

8 月 VS Code 版 GitHub Copilot:智能体会话与 /btw

GitHub 8 月 31 日针对 VS Code 1.132–1.135 的更新日志新增了并排的智能体聊天、共享上下文和提示缓存的 /btw 旁路对话、提示时间线、可移植的 Agent Plugins 1.0、多窗口 Agent Host 会话,以及实验性的 /rubber-duck 第二意见。聊天新增全文记录搜索和置顶提示;内置浏览器可为智能体标注页面元素;设备端听写新增多语言支持和感知 shell 的清理功能。

模型

DeepMind 试点前沿 AI 双盲评估

Google DeepMind 于 8 月 27 日表示,正在试点其所称的首个针对专有前沿模型的双盲评估:外部测试在加密的 Confidential Space 环境中运行,评估方看不到 Gemini 权重,谷歌也看不到评估方的提示词。合作伙伴包括新加坡 AI 安全研究所、OpenMined、AVERI 和 MLCommons,首先在保密基准上测试一个 Gemini Flash Lite 模型。目标是减少基准污染,并增强对敏感安全测试的信任;这不是 Gemini 的新消费级功能,不是 Omni 视频,也不是 Gemini 加密货币交易所。

工具

Claude Fable 5.1 登陆 GitHub Copilot

GitHub 于 9 月 1 日表示,Claude Fable 5.1 已在 Copilot 中面向 Pro+、Max、Business 和 Enterprise 正式可用,覆盖 VS Code、Visual Studio、CLI、编码智能体、github.com、Mobile、JetBrains、Xcode 和 Eclipse(逐步推出)。Business 和 Enterprise 管理员需要启用一项默认关闭的策略。与 Copilot 中大多数其他 Claude 模型不同,Fable 5.1 默认会为 Anthropic 的安全分类器保留提示词和输出(不用于训练);符合条件的企业可在 EFS 之前获得限时的零数据保留。

工具

Photoshop 推出 AI 辅助编辑器测试版和 Instruct Edit

Adobe 于 8 月 27 日表示,Photoshop 的 AI 辅助编辑器进入测试阶段:这是一个基于提示词的专用工作区,包含 Prompt to Edit、生成式填充/扩展/放大、移除和 AI 标记。带蒙版的 Instruct Edit(Firefly Image 5)允许用文字描述编辑,同时保护未被蒙版覆盖的人脸、标志或品牌素材;Prompt to Edit 也会以生成式图层的形式出现在专业编辑器的上下文任务栏中。

工具

Antigravity Teamwork 将智能体与 Gemini 3.7 Flash 结合

谷歌于 8 月 31 日表示,Antigravity Teamwork 是一个让自主多智能体团队连续数小时或数天协作的框架,与 Gemini 3.7 Flash 搭配后加快了长周期的数学和工程工作。文章列举了已解决的七个理论计算机科学开放问题(包括在 Lean 中验证的 Knuth 循环猜想)、一个可启动 xv6 的周期精确 RISC-V 模拟器,以及在 Eigen 和 ParlayHash 上游取得的成果。

工具

Anthropic 开放 Model Hardware Standard 研究预览

Anthropic 开放了 Model Hardware Standard(MHS)的研究预览。这是一套共享、与模型无关的规范,让 AI 智能体能通过 MCP 等协议操作可编程的实验室和制造设备。早期合作伙伴涵盖生物技术、显微成像和量子领域(包括 Genentech、HHMI Janelia 和 QuEra);Anthropic 计划在预览之后开源 MHS,并正在构建物理安全评估。目前仅提供候补名单:这是研究预览,不是面向所有人的 Claude 通用功能。

工具

Google Pics 将 AI 图像编辑带入 Docs 和 Slides

谷歌正向 Google AI Pro 和 Ultra 订阅用户以及大多数 Workspace 企业客户推出基于 Nano Banana 模型的 AI 图像创作与编辑工具 Google Pics。功能包括对象分离、图中文字编辑与翻译、多选项生成和协作;Docs 和 Slides 今天起集成,Drive 将在未来几周跟进。可访问 pics.new 试用;这里指的是 Workspace Pics,而不是 Gemini 的视频生成。

工具

ChatGPT 广告年化收入达 10 亿美元,Ads Manager 扩大范围

OpenAI 称,ChatGPT 广告在上线不到 200 天内年化收入达到 10 亿美元,广告主达数万家。自 8 月 31 日起,广告主可在印度、欧洲、中东和北非通过 Ads Manager 直接购买 ChatGPT 广告;以色列不在官方自助服务国家名单中。广告与订阅、企业和 API 收入并存,并为拥有超过 10 亿周活跃用户的广告支持免费层提供资金。