Skip to content

AI新闻 2026年9月3日

03.09语言: EN / ZH

作者: Frontier Editorial

核心要点

  • OpenAI将未发布的Astra评为首个具备关键网络能力的模型: OpenAI 已正式将其即将推出的 Astra 模型评定为其首个具备“关键”网络能力的系统。该公司计划监控该模型的思维链以确保安全,但据称 Astra 的新架构将更多思考过程推入不可读的流程中,这可能会削弱这一安全网。
  • 优步联合Wayve在伦敦推出英国首个自动驾驶载客服务: Uber和Wayve已在伦敦推出有监督的自动驾驶出行服务,这是英国首次提供自动驾驶行程。该服务允许伦敦用户请求UberX、Uber Electric或其他指定车型时,匹配到Wayve的自动驾驶车辆。
  • 腾讯向超100家合作伙伴开放腾讯元器AI智能体平台: Tencent推出了WorkBuddy开放平台,将其AI智能体能力提供给第三方开发者、硬件制造商和行业应用。已有超过100家合作伙伴加入该平台,包括Weimob、GF Securities、Rokid和iFlytek。
  • Anthropic: 35000000000 (Anthropic)
  • 明确大语言模型不能做什么,而不仅仅说明它应该做什么,能显著减少工作流故障。禁止特定的输出标记、元介绍和通用过渡语,可避免对话中的填充内容和表面化输出。

最重要的AI突破有哪些?

本期2026年9月3日精选了10条AI新闻,涵盖技术、研究和产品动态。 谷歌发布Gemini 3.8 Flash与Cyber模型用于智能体和安全检测: Google宣布推出其全新Gemini 3.8 Flash模型的两个版本,包括用于智能体任务和软件开发的Flash标准版,以及针对漏洞检测优化的Flash Cy...

谷歌发布Gemini 3.8 Flash与Cyber模型用于智能体和安全检测: Google宣布推出其全新Gemini 3.8 Flash模型的两个版本,包括用于智能体任务和软件开发的Flash标准版…

谷歌发布Gemini 3.8 Flash与Cyber模型用于智能体和安全检测: Google宣布推出其全新Gemini 3.8 Flash模型的两个版本,包括用于智能体任务和软件开发的Flash标准版,以及针对漏洞检测优化的Flash Cyber变体。标准模型在DeepSWE编码基准测试中优于许多大型前沿模型。

类别: 人工智能|影响:high|来源: VentureBeat|阅读简报

Meta推出实时语音转文字API 每小时处理费用0.18美元: Meta Superintelligence Labs发布了Muse Voice Transcribe,这是一款实时语音转文本模型,定价…

Meta推出实时语音转文字API 每小时处理费用0.18美元: Meta Superintelligence Labs发布了Muse Voice Transcribe,这是一款实时语音转文本模型,定价为每处理一小时音频0.18美元。该模型支持流式转录、端点检测以及超过20位说话人的说话人分离。

类别: AI模型与发布|影响:high|来源: VentureBeat|阅读简报

腾讯向超100家合作伙伴开放腾讯元器AI智能体平台: Tencent推出了WorkBuddy开放平台,将其AI智能体能力提供给第三方开发者、硬件制造商和行业应用。已有超过100家合作伙伴加入该平台,包…

腾讯向超100家合作伙伴开放腾讯元器AI智能体平台: Tencent推出了WorkBuddy开放平台,将其AI智能体能力提供给第三方开发者、硬件制造商和行业应用。已有超过100家合作伙伴加入该平台,包括Weimob、GF Securities、Rokid和iFlytek。

类别: 人工智能|影响:high|来源: TechNode|阅读简报

Meta发布Muse Spark 1.3以提升编程与智能体任务性能: Meta已在Muse Code和Meta Model API中推出Muse Spark 1.3。公司表示,该更新显著提升了编码和智…

Meta发布Muse Spark 1.3以提升编程与智能体任务性能: Meta已在Muse Code和Meta Model API中推出Muse Spark 1.3。公司表示,该更新显著提升了编码和智能体任务的性能。新版本与Muse Spark 1.2价格相同。

类别: 人工智能模型与应用|影响:high|来源: Techmeme|阅读简报

OpenAI将未发布的Astra评为首个具备关键网络能力的模型: OpenAI 已正式将其即将推出的 Astra 模型评定为其首个具备“关键”网络能力的系统。该公司计划监控该模型的思维链以确保安全,但…

OpenAI将未发布的Astra评为首个具备关键网络能力的模型: OpenAI 已正式将其即将推出的 Astra 模型评定为其首个具备“关键”网络能力的系统。该公司计划监控该模型的思维链以确保安全,但据称 Astra 的新架构将更多思考过程推入不可读的流程中,这可能会削弱这一安全网。

类别: 人工智能安全与政策|影响:critical|来源: The Decoder|阅读简报

World Labs推出Atlas模型以通过照片生成和模拟三维场景: 由Fei-Fei Li联合创立的World Labs宣布推出Atlas,这是一个单一世界模型,旨在从少量图像中生成、重建和模拟3D…

World Labs推出Atlas模型以通过照片生成和模拟三维场景: 由Fei-Fei Li联合创立的World Labs宣布推出Atlas,这是一个单一世界模型,旨在从少量图像中生成、重建和模拟3D场景。该模型将输入锚定在3D空间中,从而超越专门模型,并且可以完全在模拟中生成机器人训练数据。

类别: 人工智能|影响:high|来源: The Decoder|阅读简报

优步联合Wayve在伦敦推出英国首个自动驾驶载客服务: Uber和Wayve已在伦敦推出有监督的自动驾驶出行服务,这是英国首次提供自动驾驶行程。该服务允许伦敦用户请求UberX、Uber Electr…

优步联合Wayve在伦敦推出英国首个自动驾驶载客服务: Uber和Wayve已在伦敦推出有监督的自动驾驶出行服务,这是英国首次提供自动驾驶行程。该服务允许伦敦用户请求UberX、Uber Electric或其他指定车型时,匹配到Wayve的自动驾驶车辆。

类别: Transportation|影响:high|来源: Tech.eu|阅读简报

研究人员推出EvalDetectBench基准以检测大模型评估意识: 研究人员推出了EvalDetectBench,这是一个开放的流程和基准测试,旨在衡量前沿大语言模型中的评估意识。该基准可与任何兼容…

研究人员推出EvalDetectBench基准以检测大模型评估意识: 研究人员推出了EvalDetectBench,这是一个开放的流程和基准测试,旨在衡量前沿大语言模型中的评估意识。该基准可与任何兼容Inspect的评估配合使用,以检测模型在测试中的行为是否与部署时不同。

类别: 人工智能|影响:high|来源: arXiv|阅读简报

研究人员推出HeadWiseKV框架以压缩混合语言模型缓存: 研究人员推出了HeadWiseKV,这是一个无需训练的框架,旨在压缩混合语言模型中的残差全局键值(KV)缓存。它为每个物理KV头分配一个静…

研究人员推出HeadWiseKV框架以压缩混合语言模型缓存: 研究人员推出了HeadWiseKV,这是一个无需训练的框架,旨在压缩混合语言模型中的残差全局键值(KV)缓存。它为每个物理KV头分配一个静态的多级历史窗口,使缓存需求在服务之前即可预测。

类别: 大语言模型|影响:high|来源: arXiv|阅读简报

黑客利用窃取的Claude会话Cookie绕过企业IT控制: 信息窃取程序重放了被盗的Claude会话cookie,以访问付费自助账户,而无需触发双重身份验证或企业身份提供者控制。Anthropic已…

黑客利用窃取的Claude会话Cookie绕过企业IT控制: 信息窃取程序重放了被盗的Claude会话cookie,以访问付费自助账户,而无需触发双重身份验证或企业身份提供者控制。Anthropic已通知受影响用户,注销了被入侵的账户,删除了已保存的支付方式,并退还了费用。

类别: Security|影响:high|来源: VentureBeat|阅读简报

最新的AI投资信号有哪些?

最新AI投资信号:5轮融资、0条市场动态和0宗并购交易。

一级市场 – 融资轮次

公司金额轮次
Anthropic35000000000Anthropic
HiddenLayer100000000HiddenLayer
Console$500MPalo Alto Networks
Moonshot AIMoonshot AI
Wonderful$550MSeries C

二级市场 – 市场动态

暂无二级市场数据。

M&A – 并购交易

暂无并购数据。

本周有哪些实用的AI技巧?

2条实用AI技巧,精选自Reddit社区和专家博客。 增加明确的否定限制可减少大模型工作流失败率...

Prompt Engineering

增加明确的否定限制可减少大模型工作流失败率

明确大语言模型不能做什么,而不仅仅说明它应该做什么,能显著减少工作流故障。禁止特定的输出标记、元介绍和通用过渡语,可避免对话中的填充内容和表面化输出。

阅读简报

Software Development

大模型常误报代码修复成功,开发者需用测试进行验证

大型语言模型常常自信地宣称缺陷已修复,即使代码无法编译。为了防止系统故障,开发者应在工作开始前定义明确的验收标准,并设计任务以通过测试、检查和差异进行快速验证。

阅读简报