每日精选AI前沿动态
今日国产AI力量集中发力,商汤、蚂蚁百灵、腾讯混元同日发布新模型。开源生态持续繁荣,端侧推理和本地微调方案也在快速进步,AI能力正以前所未有的速度走向普及。
🔋 Anthropic与初创公司Volta签署大额算力协议
来源:社交媒体
Anthropic与成立仅数月的云初创公司Volta签署大额算力协议。Volta的硬件几乎全为租用,算力来自Bitdeer挪威站点,芯片由Nvidia供应、Dell组装。Anthropic看中的是交付速度,这笔交易也折射出当前AI算力需求之迫切。
🚗 工信部发布首部L3/L4自动驾驶系统安全要求强制性国标
来源:IT之家
工信部组织制定的《智能网联汽车 自动驾驶系统安全要求》(GB 44721—2026)强制性国家标准获批发布,拟于2027年7月1日起实施。这是我国首部针对L3级有条件自动驾驶和L4级高度自动驾驶系统的强制性国标,由2024年推荐性国标升级而来,为自动驾驶产品明确了统一的安全准入基线。
💲 GPT-5.6 Luna降价80%永久生效
来源:社交媒体
OpenAI确认GPT-5.6 Luna降价80%为永久调整,并非临时促销。官方表示效率提升是结构性的,不会逆转。这意味着同等性能的推理成本大幅降低,对AI应用开发者是实质利好,也将进一步加速AI应用的普及。
💡 技巧与观点
⚡ 在单颗AMD MI300X上运行DeepSeek V4 Flash
来源:Hacker News
一个开源仓库提供了在单颗AMD MI300X上生产运行DeepSeek-V4-Flash的完整配置与补丁,无需额外量化或权重卸载。该304B参数模型在192GB HBM上实现单流168.6 tok/s解码、8并发流542 tok/s聚合吞吐,并验证了256K上下文,充分展现了MI300X在大模型推理中的潜力。
🍎 MiniMax-H3通过MLX移植可在Apple Silicon上运行
来源:Simon Willison 博客
MiniMax发布的MiniMax-H3是一个通用全模态生成系统,可接受文本、图像、音频和视频输入并生成最长15秒带音频视频片段。开发者将其移植到MLX框架,支持Apple Silicon运行。在M5 Max MacBook Pro上实测,下载约115GB模型文件后,视频生成耗时不到45分钟。
🔧 Cloudflare用软件工厂将Astro的GitHub issue数降至零
来源:Cloudflare Blog
Cloudflare在Astro仓库上运行自动化triage流水线,通过隔离的AI子代理复现、诊断并修复bug,将开放issue从200多个降至约30个,预计下月归零。该流水线由issue标签驱动,修复后自动发布预览版本供用户验证。其底层引擎已发展为Flue,一个开源的平台无关框架,可用于构建持久化智能体与工作流。
📦 GitHub用堆叠式Pull Request拆解AI生成的巨型代码
来源:GitHub Blog
GitHub介绍用堆叠式Pull Request(stacked PR)解决AI编码智能体生成巨型代码难以审查的问题。通过将1,000+行的大diff按数据、API、接线、UI拆成L1-L4四个独立分层,每层可分配不同审查者,大幅提升审查效率。这是AI辅助编程时代工程实践适配的一个典型案例。
🛠️ 从零用Codex搓出你的第一个硬件
来源:公众号:数字生命卡兹克
作者以零基础身份,全程通过与Codex对话,从需求讨论、电路搭建、代码烧录到3D打印组装,5天内做出一个能提醒久坐的猫爪硬件。文中还介绍了用Agent调试宏键盘、以及OpenAI与Work Louder联名发布的Codex Micro键盘等案例,充分展示了"干中学"的AI开发新范式。
🚀 产品发布/更新
🖥️ Swiftlet:在Mac上运行80B版Qwen(内存仅需4.3GB)
来源:Hacker News
Swiftlet是一个Swift + Metal运行时,可在普通Apple设备上运行Qwen3-Next和Qwen3.5/3.6 MoE混合模型。其核心思路是仅将小型稠密核心驻留内存,按需从存储流式加载路由专家权重,实现Mac上80B模型仅需4.3GB内存、iPhone上运行35B版本的突破,让端侧大模型推理迈入实用阶段。
🔥 面壁智能开源ForgeStencil:一周自动优化100+工业与科学软件
来源:公众号:面壁智能
面壁智能联合OpenBMB开源全球首个支持Stencil自动研究、自动部署的AI优化系统ForgeStencil。由Kernel Agent与App Agent闭环协作,实现从算子优化到应用集成的全自动流程,全程零人工介入,一周内自动优化了100多个工业与科学软件,展现了AI在系统优化领域的巨大潜力。
🔧 OpenRouter推出ori CLI:为Claude Code等提供开箱即用配置
来源:OpenRouter Blog
OpenRouter发布ori CLI,用户安装并登录后即可获得针对Claude Code、Codex、OpenCode、Hermes等harness的优化配置,省去手动设置大量环境变量的麻烦,大幅降低AI编程工具的使用门槛。
🎨 Replit环境智能:免提示词自动生成设计
来源:社交媒体
Replit推出环境智能(Ambient Intelligence)功能,无需提示词或设计语言,系统会在每个画面旁显示建议卡片,每张卡片指向不同的设计方向。点击即可生成新画面,用户不再需要纠结下一步该做什么,让设计创作变得更加直觉化。
🔩 Soup v0.72.4:在4GB显存笔记本GPU上微调8B模型
来源:Hacker News
Soup推出v0.72.4,支持在配备4GB显存的笔记本GPU上通过QLoRA微调8B模型,无需SSH或云服务,让个人开发者也能在普通笔记本上完成模型微调,进一步降低了AI开发的硬件门槛。
🤖 模型发布/更新
🚗 NVIDIA Alpamayo 2 Super开放商用:面向自动驾驶的前沿开源模型
来源:NVIDIA Blog
NVIDIA Alpamayo 2 Super现已开放商用,基于Cosmos 3 Super Reasoner构建,采用强化学习后训练,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出,面向Robotaxi与自动驾驶场景,为自动驾驶领域提供了一个强大的开源基础模型。
🧠 商汤SenseNova U1开源:统一推理与图像生成
来源:社交媒体
商汤发布开源模型SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,如演示六步画龙教程。模型已上线SenseNova Studio、HuggingFace及GitHub。
🐜 蚂蚁百灵发布Ling-3.0-flash开源权重
来源:社交媒体
蚂蚁百灵发布Ling-3.0-flash的开源权重,提供官方BF16和FP8量化版本,用户可根据自己的硬件、性能要求和部署需求选择最合适的版本,灵活性很高。
🎬 OpenRouter上线FLUX 3 Video统一多模态模型
来源:社交媒体
Black Forest Labs的FLUX 3 Video现已在OpenRouter上向所有人开放。这是一个统一的视频、音频、图像和动作预测多模态模型家族,基于统一架构联合训练,支持严肃、有趣、创意、真实、电影感等多种风格输出。
🎙️ 腾讯混元发布Hy ASR 3.0 preview:真正懂上下文的语音识别
来源:公众号:腾讯混元
腾讯混元发布新一代语音识别模型Hy ASR 3.0 preview,基于大语言模型Hy3与MoE架构,融合高精度识别与语义理解。在开源评测集中中文普通话WER 3.34%、英语WER 2.62%、粤语WER 3.12%,并支持上下文纠错、热词注入及高噪耳语等场景。该模型已上线腾讯云API,元宝App首发并免费开放。
夜雨聆风