夜雨聆风学习资料网

ARTICLE · 1153947

AI快报:TRAE软件大合并 豆包工作新增无限画布 NVIDIA 推出 Jetson Agent Skills

AI快报:TRAE软件大合并 豆包工作新增无限画布 NVIDIA 推出 Jetson Agent Skills

导 语

10月9日,AI智能体与企业级落地持续推进。字节旗下TRAE宣布TraeWork与TraeCode合并为统一全链路开发平台;中国电信办公智能体TeleAgent注册用户突破150万、日活超20万;豆包工作新增无限画布并接入豆包2.1 Lite与Seedream 5.0 Flash,App端又开通水电气缴费能力;Cloudflare开放多模态决策模型Clef-omni权重,NVIDIA与LightOn等也带来端侧与文档智能新工具。智能体开始真正接管多步骤任务,国内大厂的全链路开发与个人办公入口正在被重新组合,AI渗透工作的速度会比我们想象的更快吗?

国内动态

豆包工作上线无限画布:任务模式接入豆包 2.1 Lite 与 Seedream 5.0 Flash

平台:豆包官方(火山引擎)  |  日期:2026-10-09

豆包工作10月9日宣布任务模式新增无限画布功能,支持素材、方案、成果铺在同一张画布上随时查看、对比与整理。生成内容可继续调整文字、配色与布局,定位复杂任务专用。同期上线豆包 2.1 Lite 模型,多模态综合能力领先,主打文档撰写、表格处理与PPT制作等高频办公场景,并接入全新 Seedream 5.0 Flash 图片模型扩展生图选择。

中国电信办公智能体 TeleAgent 注册用户突破 150 万,日活超 20 万

平台:中国电信官方(Media OutReach)  |  日期:2026-10-09

中国电信10月9日在PT Expo China 2026宣布办公智能体TeleAgent注册用户突破150万、日活跃用户超20万,自6月中旬的2.7万注册用户实现陡峭增长。TeleAgent依托自研星辰多模态大模型与"五合一"智云,技能市场从4万扩至5万,99%由终端用户自建,原生支持Windows、macOS、麒麟与统信UOS,咨询类用户把过去半天的报表整理压缩至5分钟。

字节 TRAE 合并 TraeWork 与 TraeCode:统一入口支持 Agent / IDE 双模式

平台:字节 TRAE 官方  |  日期:2026-10-09

字节旗下TRAE 10月9日宣布TraeWork与TraeCode正式合并为全新TRAE,升级为全链路开发平台,过去分散在办公、任务、内容生成与专业编码两端的入口统一收敛至同一处,新版同步支持Agent模式与IDE模式无缝切换。合并后支持Agent模式与IDE模式无缝切换,覆盖桌面、Web与移动端,开发者可在电脑上启动任务、移动端查看进度、桌面端继续深入开发,聊天记录、账号、本地数据与商业积分完整迁移,分批灰度推送中。

极米 MemoMind One 开启预约:无摄像头 AI 显示眼镜,16 小时综合续航

平台:极米官方 / 钉科技  |  日期:2026-10-09

极米MemoMind One 10月9日开启国内电商预约,采用整机无摄像头方案规避影像采集风险,蔡司显示系列翎思镜片搭配哈曼调校音频,镜架黄金配重。通过欧盟EN 18031隐私标准认证并开放个性化隐私管理,AI能力集中在Memo记忆系统、双目显示、语音交互、实时翻译与演讲辅助,商务演讲文稿直接投放到视野,海外交流时翻译文字在镜片显示,综合续航16小时,开放近视处方定制与多款镜框。

海外动态

Cloudflare 开放 Clef-omni 权重:首款支持音视频输入的多模态决策模型

平台:Cloudflare 官方  |  日期:2026-10-09

Cloudflare 10月9日在Workers AI上线Clef-omni决策模型并同步在Hugging Face开放权重,可一次性接收文本、图像、音频与视频输入并对预定义选项做单次评分,文本约20毫秒、21秒视频约300毫秒。模型基于Qwen3-Omni-30B-A3B混合专家冻结主干训练,原生支持音视频省略传统级联ASR与切片流程;同期Clef-flash降价至低于Jev的水平,原版Clef速度提升。

NVIDIA 推出 Jetson Agent Skills:让编码智能体直接操控边缘硬件

平台:NVIDIA 官方  |  日期:2026-10-09

NVIDIA 10月9日发布Jetson Agent Skills工具包与JetPack 7.2.1,把设备级诊断、模型服务与视频流水线流程打包成技能,向Claude Code、Codex等编码智能体开放Jetson设备能力直接调用,硬件配置工作流由智能体在终端侧完成,进一步把Agent能力从云端PC延伸到嵌入式边缘AI开发场景。

Gamma 5 重写演示平台:智能体一键规划整套演示文稿

平台:Gamma 官方  |  日期:2026-10-09

Gamma 10月9日发布Gamma 5演示平台,主打Agent-Led Creation,用户给出上下文与视觉参考后由智能体规划整套演示文稿,配合支持任意位置自由摆放元素的Freeform编辑器。同步新增企业级连接器,支持导入PowerPoint与PDF等现有文件,定位从"演示模板"升级为"演示协作智能体",进一步压缩从内容构思到正式演示的链路。

技术与应用

豆包 App 开通水电气缴费:个人智能体从对话走向办事

平台:豆包官方 / 每日经济新闻  |  日期:2026-10-09

豆包App 10月9日被实测可通过语音或打字完成水电气等生活缴费,登录抖音账号、绑定户号后即可使用。接近豆包人士确认正在逐步建设包括出行服务、生活缴费等生活场景下的办事能力,国庆前已上线"出行用豆包"专属入口,涵盖地图导航、交通出行、酒店住宿、吃喝玩乐四大场景,机票、火车票、打车与路线导航陆续接入,标志个人智能体从对话工具向生活办事入口延伸。

LightOn 开源 LightOnOCR-3:0.8B/4B 文档智能模型,处理速度较前代翻倍

平台:LightOn 官方  |  日期:2026-10-09

LightOn 10月9日开源LightOnOCR-3 0.8B与4B两款文档智能模型,单步同时处理文字、手写、图像与图表并保留文档结构。模型在ParseBench与OlmOCR-Bench榜单领先,处理速度较前代提升至两倍,Apache 2.0许可面向社区免费使用,为企业级RAG、合同抽取与表格识别提供新的轻量级开源基座。

开源项目推荐

微软联合上海交大开源 FastContext:4B 子模型接管 Coding Agent 找代码环节

平台:微软官方 + 上海交通大学 / GitHub(microsoft/fastcontext)  |  日期:2026-10-10

微软与上海交大10月10日联合开源FastContext,把Coding Agent的仓库探索从主模型解耦为4B-30B按需调用的子模型并行搜索,只返回文件路径与行号。论文基于对GPT-5.4-high在SWE-bench Multilingual上300条完整轨迹的拆解,发现读、搜索两类操作合计占主模型Token的46.5%,接入Mini-SWE-Agent后端到端修复率最高提升5.5%,主模型Token消耗最高减少60%,论文已发布于arXiv:2606.14066。

Speridlabs 开源 Iris-3B:3B 像素空间文生图模型,无需 VAE

平台:Speridlabs 官方 / Hugging Face  |  日期:2026-10-09

Speridlabs 10月9日开源Iris-3B像素空间文生图模型,3B参数规模,绕过传统VAE直接生成像素,采用flow-matching Transformer架构。模型Apache 2.0许可,权重与推理代码均公开。除了常规文生图任务,其生成式先验还可用于深度估计与图像修复等细粒度视觉任务,为端侧与无VAE架构的视觉模型研究提供新的开源基座。

相关学习资料