
AI日报 2026-08-18
概览
要闻
- •保障AI基础设施安全 ↗
#1
模型发布
- •GPT 5.6 Sol 被认为是OpenAI迄今最好的视觉模型 ↗
#2 - •世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成 ↗
#3
产品应用
- •使用Qwen 3.8模型通过两个提示生成完整游戏 ↗
#4
开源项目
- •llama.cpp提交自适应MTP拉取请求PR#27210 ↗
#5
学术论文
- •不要声称基准导向的优化能提升通用编码能力——需要多样化评估 ↗
#6
技术与洞察
- •本地智能体编码基准测试:Qwen 3.8 27B对比其他模型 ↗
#7
行业动态
- •Nvidia向软银数据中心开发商投资15亿美元,锁定OpenAI项目芯片供应 ↗
#8 - •AI自动化初创公司Relay关闭,员工加入Google Chrome团队 ↗
#9 - •亚马逊销毁稀有书籍以训练AI模型 ↗
#10 - •Groq融资3.5亿美元,从AI芯片转向neocloud业务 ↗
#11 - •AI 生成的 GitHub Copilot Autofix 功能导致 Snowflake 的 Jira 被攻破 ↗
#12 - •Wispr 获 2.8 亿美元融资,估值达 20 亿美元,业务拓展至会议记录 ↗
#13 - •语音转文字AI初创公司估值达20亿美元 ↗
#14
前瞻与传闻
- •Stripe以超70亿美元收购OpenRouter,估值飙升5倍 ↗
#15
保障AI基础设施安全 #1
NVIDIA将AI工厂定义为AI时代的关键基础设施,强调计算将能源和数据转化为智能,支撑所有行业和国家,并呼吁加强安全防护。
NVIDIA提出AI工厂是AI时代定义性的基础设施,计算将能源和数据转化为智能,驱动每个企业、行业和国家的发展。
在AI经济中,计算成为核心资产,而AI工厂作为大规模计算中心,其安全性至关重要。物理安全和网络安全需同步加强,以防数据泄露和攻击。
NVIDIA呼吁行业共同制定安全标准,确保AI工厂的可靠运行,从而支撑全球智能化转型。
相关链接:
- •https://blogs.nvidia.com/blog/securing-the-infrastructure-of-intelligence/
GPT 5.6 Sol 被认为是OpenAI迄今最好的视觉模型 #2
OpenAI发布的GPT 5.6 Sol被社区评价为最佳的视觉模型,在图像识别和理解方面表现突出,超越了以往所有OpenAI视觉模型。
GPT 5.6 Sol作为OpenAI最新视觉模型,在多个基准测试中取得领先成绩,能够处理复杂图像任务,包括物体检测、场景理解等。
社区用户对其性能给予高度评价,认为其在图像识别准确率和理解深度上超越了前代模型。
目前该模型的具体技术细节和官方发布信息尚未完全披露,但已引发广泛关注。
相关链接:
- •https://blog.roboflow.com/openai-gpt-5-6/
世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成 #3
研究团队发布的世界模型首次实现24FPS视频与48kHz立体声的实时同步生成,即将完全开源,将推动多模态AI应用发展。
该模型能够根据文本描述或动作指令,实时生成连贯的视听内容。与以往仅生成静音视频的世界模型不同,新模型将音频作为独立通道与视觉流并行生成,并保持精确的时间同步。
技术细节上,模型采用统一的时空编码器-解码器架构,联合训练视觉和音频模态。在生成过程中,24FPS的视频帧与48kHz的立体声波形同步输出,延迟低于实时交互的要求。
研究团队宣布将完全开源模型权重、训练代码和数据集,以促进社区研究和应用。该模型可应用于机器人模拟、自动驾驶、游戏开发和虚拟现实等领域。
相关链接:
- •https://www.qbitai.com/2026/08/474334.html
使用Qwen 3.8模型通过两个提示生成完整游戏 #4
用户利用Qwen 3.8模型仅通过两个提示(一个构建提示、一个修复提示)生成了一款包含HTML、CSS和JavaScript的完整游戏,无需外部资源。
该游戏完全由Qwen 3.8模型生成,第一个提示用于构建基本游戏逻辑和界面,第二个提示修复了玩家被炸弹卡住和敌人路径寻找错误两个问题。所有代码均为纯前端实现,无外部依赖。
这一案例展示了当前大型语言模型在代码生成方面的快速迭代能力,尤其是在少样本情境下完成复杂交互式应用的能力。
用户表示整个过程仅需两个提示,且模型能够准确理解上下文并修复具体问题,反映出Qwen 3.8在代码理解和生成方面的实用性。

相关链接:
- •https://www.reddit.com/r/LocalLLaMA/comments/1vrabno/made_this_game_in_two_prompts_with_q4_qwen_38_is/
llama.cpp提交自适应MTP拉取请求PR#27210 #5
llama.cpp项目提交了一个自适应多令牌预测(MTP)功能的拉取请求,通过计数状态机动态决定是否使用MTP,以提升推理效率。
该PR(Pull Request)编号为#27210,为llama.cpp引入了一种自适应MTP(Multi-Token Prediction)模式。
其核心是一个简单的计数状态机,用于根据当前推理状态动态决定何时启用MTP,从而在保持模型性能的同时降低计算开销。
社区用户被邀请测试该功能,有望进一步优化本地大模型推理的速度和资源利用率。

相关链接:
- •https://www.reddit.com/r/LocalLLaMA/comments/1vqzud4/llamacpp_adaptive_mtp_pr27210/
不要声称基准导向的优化能提升通用编码能力——需要多样化评估 #6
该研究指出,在少量编码基准(如SWE-bench、LiveCodeBench)上优化模型并不能证明其通用编码能力提升,呼吁采用多样化评估方法。
当前许多后训练论文、模型卡和博客文章将少量编码基准(如SWE-bench和LiveCodeBench)的分数提升作为模型编码能力改善的证据。该研究对此提出质疑,认为这种基准导向的优化可能导致过拟合和评估偏差。
通过系统分析,作者发现模型在特定基准上的表现提升往往无法泛化到其他未见的编码任务,且基准之间的重叠和偏向性进一步削弱了评估的可信度。
该研究呼吁社区采用多样化、覆盖多种编程范式、语言和难度级别的评估框架,以真实反映模型的通用编码能力,避免误导性结论。
相关链接:
- •https://arxiv.org/abs/2608.13566
本地智能体编码基准测试:Qwen 3.8 27B对比其他模型 #7
一份本地智能体编码基准测试显示,Qwen 3.8 27B在中度推理模式下得分高于3.6版本,且请求量和令牌生成量显著减少,效率优于DeepSeek v4 Flash。
该测试在多种量化、缓存量化、引擎和推理强度设置下对比了Qwen 3.8 27B与其他模型。结果显示,在中度推理模式下,Qwen 3.8 27B不仅得分高于3.6版本,而且效率大幅提升:所需请求次数减少近一半,生成的令牌数量减少三分之一。
对比对象包括DeepSeek v4 Flash 3107 MXFP4,Qwen 3.8 27B在同等或更低资源消耗下取得了更好成绩。
测试还涉及不同权重量化(如Q4、Q8)和缓存量化对性能的影响,为开发者选择本地部署模型提供了参考。该基准测试注重智能体编码任务,即模型自主编写代码的能力。



相关链接:
- •https://www.reddit.com/r/LocalLLaMA/comments/1vr4bs4/local_agentic_coding_benchmark_qwen_38_27b_in/
Nvidia向软银数据中心开发商投资15亿美元,锁定OpenAI项目芯片供应 #8
Nvidia投资15亿美元于软银旗下数据中心开发商,以确保其芯片被用于为OpenAI建设的数据中心,巩固AI基础设施供应地位。
Nvidia宣布向软银集团旗下的数据中心开发公司投资15亿美元,这笔投资将用于建设专门为OpenAI服务的数据中心。作为回报,该数据中心将优先采用Nvidia的GPU芯片,从而确保OpenAI庞大的算力需求由Nvidia供应。
软银的数据中心开发商此前已承接多个大型AI项目,此次合作将进一步巩固Nvidia在AI训练和推理硬件市场上的主导地位。同时,OpenAI获得了稳定且大规模的计算资源,加速其下一代模型研发。
这笔投资是Nvidia在AI基础设施领域的又一重要布局,也反映出数据中心建设对AI公司的战略价值。随着AI竞赛加剧,芯片供应商与云服务商的绑定将更加紧密。
相关链接:
- •https://techcrunch.com/2026/08/17/nvidia-investing-1-5b-in-softbank-data-center-developer-behind-openai-project/
AI自动化初创公司Relay关闭,员工加入Google Chrome团队 #9
AI自动化初创公司Relay宣布关闭,其创始人及员工加入Google Chrome团队,将专注于在Chrome浏览器中集成AI功能。
Relay是一家提供AI自动化工作流服务的初创公司,其创始人兼CEO Jacob Bank表示公司关闭并加入Google。他称“我们在Chrome中利用AI完成任务方面有一些非常雄心勃勃的计划,很快会有更多分享”。
Relay的团队将并入Google Chrome部门,专注于浏览器端的AI助手功能。此前Chrome已推出AI写作助手、标签页分组等实验性功能。
此次收购(实质上是人才收购)表明Google正在加强Chrome与AI的整合,可能涉及任务自动化、网页理解等方向。
相关链接:
- •https://techcrunch.com/2026/08/17/ai-automation-startup-relay-shuts-down-staff-joins-googles-chrome-team/
亚马逊销毁稀有书籍以训练AI模型 #10
报道称亚马逊正在销毁稀有书籍,将其用于训练AI模型,引发对文化遗产破坏和数据伦理的强烈争议。
亚马逊被曝出正在销毁稀有书籍,这些书籍被用作训练大型语言模型的训练数据。稀有书籍因其独特内容和罕见性,对AI模型提升知识覆盖和文本质量具有极高价值,但破坏实体书籍的做法引发了广泛批评。
亚马逊最初是一家在线书店,如今却将珍贵书籍视为训练材料,这一反差加剧了公众的愤怒。书籍所有者或捐赠者可能并未同意书籍被销毁,亚马逊的数据获取方式是否存在法律和道德问题尚待调查。
该事件凸显了AI行业在数据采集方面的激进做法,以及保护文化遗产与技术进步之间的冲突。目前亚马逊尚未对此发表正式回应。
相关链接:
- •https://techcrunch.com/2026/08/17/amazon-once-an-online-bookseller-is-destroying-rare-books-to-train-ai-models/
Groq融资3.5亿美元,从AI芯片转向neocloud业务 #11
Groq完成3.5亿美元融资,估值达35亿美元,公司将从AI芯片制造商转型为neocloud服务商,并扩大Nvidia数据中心规模。
Groq宣布获得3.5亿美元新一轮融资,公司估值达到35亿美元。这笔资金将用于推动其从AI芯片设计公司向neocloud业务的战略转型,即提供基于云端的AI计算服务,而非仅销售芯片。
作为转型的一部分,Groq将扩大其Nvidia GPU驱动的数据中心规模,以支持客户的大规模AI推理和训练需求。尽管Groq曾开发自有架构的AI芯片,但市场接受度有限,转型为neocloud服务商可更好地利用现有基础设施。
此次融资表明投资者看好neocloud市场前景,但竞争激烈,包括CoreWeave、Lambda Labs等对手已占据先机。Groq的转型能否成功还需观察其服务定价、性能和客户获取能力。
相关链接:
- •https://techcrunch.com/2026/08/17/groq-raises-350m-to-fuel-its-pivot-from-ai-chips-to-neocloud/
AI 生成的 GitHub Copilot Autofix 功能导致 Snowflake 的 Jira 被攻破 #12
安全研究人员发现,GitHub Copilot 的 AI 生成自动修复功能存在漏洞,攻击者利用该功能成功入侵了 Snowflake 的 Jira 系统,暴露了 AI 辅助开发工具的潜在风险。
近日一起安全事件中,攻击者利用 GitHub Copilot 的 Autofix 功能(由 AI 自动生成代码修复建议)中的漏洞,成功攻破了 Snowflake 的 Jira 实例。该漏洞允许攻击者注入恶意代码,绕过正常的代码审查流程。
研究人员指出,GitHub Copilot 的 Autofix 功能在生成修复建议时,未能充分验证上下文安全,导致可以被操纵以执行任意操作。攻击者通过构造特定的提交历史,诱使 AI 生成包含后门的修复代码。
此事件再次引发了对 AI 辅助开发工具安全性的讨论。Snowflake 已修复相关漏洞,但该案例表明,AI 生成的代码需要更严格的沙箱和审计机制,以防止被恶意利用。
相关链接:
- •https://www.wiz.io/blog/red-agent-snowflake-copilot-cicd-bug
Wispr 获 2.8 亿美元融资,估值达 20 亿美元,业务拓展至会议记录 #13
语音 AI 公司 Wispr 完成 2.8 亿美元融资,估值达 20 亿美元。资金将用于拓展业务,新推出的会议记录工具标志着其从听写领域向更广泛的办公协作场景进军。
Wispr 是一家专注于语音 AI 技术的公司,最初以听写产品闻名。近日,该公司宣布完成 2.8 亿美元 融资,估值达到 20 亿美元。本轮融资将用于扩大市场份额并进入新领域。
Wispr 近期推出了一个会议记录工具,能够自动转录、总结会议内容并提取行动项。这表明 Wispr 正在从单纯的听写应用向更全面的办公协作解决方案转型,与 Otter.ai、Fireflies.ai 等产品竞争。
该公司计划利用新资金加强研发,特别是在多语言支持和实时协作方面,同时扩大销售团队以服务企业客户。
相关链接:
- •https://techcrunch.com/2026/08/17/wispr-raises-280m-at-2b-valuation-as-it-looks-beyond-dictation/
语音转文字AI初创公司估值达20亿美元 #14
一家专注于语音转文字的人工智能初创公司最新估值达到20亿美元,成为原生AI创业浪潮中吸引大额融资的代表企业之一。
该初创公司是语音转文字(Speech-to-Text)领域的AI技术供应商,其核心技术基于深度学习模型,可将语音实时转换为文本。
公司近期完成新一轮融资,估值达到20亿美元,反映了资本市场对原生AI应用层公司的强烈兴趣。
在生成式AI热潮下,一批专注于特定垂直场景的AI原生初创企业正获得大量资金支持,语音转文字赛道是其中重要方向之一。

相关链接:
- •https://aibusiness.com/generative-ai/speech-to-text-ai-specialist-valued-at-2b
Stripe以超70亿美元收购OpenRouter,估值飙升5倍 #15
据彭博社报道,Stripe正在以超过70亿美元收购AI网关初创公司OpenRouter,这一价格较其最新估值13亿美元暴涨约5倍,凸显AI基础设施赛道的火热。
OpenRouter成立于2023年,最初作为AI模型聚合API,后逐渐发展为开发者社区和模型路由平台。其核心价值在于提供统一的模型访问接口,并支持自动切换、负载均衡和成本优化。
收购方Stripe正积极扩展其开发者生态,希望通过整合OpenRouter,为其数百万商户提供一键式AI能力集成。此外,OpenRouter的800万用户群体也将直接转化为Stripe的潜在客户。
该交易尚未最终签署,但若成功,将成为AI领域2025年最重大的并购之一。这也反映出支付巨头对AI基础设施的战略重视,预计将引发更多类似收购。

相关链接:
- •https://the-decoder.com/stripe-is-reportedly-acquiring-ai-startup-openrouter-for-more-than-7-billion/
提示:内容由AI辅助创作,可能存在幻觉和错误。
夜雨聆风