夜雨聆风学习资料网

ARTICLE · 1131218

今日AI 速报 · 2026年10月6日【TikTok推出一键结账与AI购物】

今日AI 速报 · 2026年10月6日【TikTok推出一键结账与AI购物】

1.【Reflection AI 发布首个开源权重模型 Beam:501B 参数只激活 23B,直指中国开源模型】

英伟达投资的布鲁克林初创公司 Reflection AI 于 10 月 5 日通过官方博客发布其首款前沿开源权重模型 Beam,采用稀疏 MoE 架构,总参数 501B、每个 token 仅激活 23B,预训练用了 23.8 万亿 token,支持 100 万 token 上下文。公司称 Beam 在高级推理基准上可与中国头部开源模型 GLM-5.2 打成平手,推理算力消耗只有对手的 1/3 到 1/4,定位是企业、公共部门与开发者的"主力机型",主打编码、推理与智能体任务。Beam 采用高算力强化学习训练,累计超过 1 亿次 rollout,动用了 1.05 万块英伟达 GB300 跑满 4 周;公司已从英伟达、红杉、Lightspeed 等融得约 47 亿美元,上一轮投前估值 250 亿美元,并与 SpaceX、Nebius 签下逾 70 亿美元算力协议锁定 GB300 至 2029 年。目前模型仍处早期访问登记阶段,权重、技术报告与模型卡将于本月晚些时候以 Apache 2.0 协议放出。

🔗 来源:https://techcrunch.com/2026/10/05/reflection-debuts-beam-a-open-weight-ai-model-to-rival-chinese-models-at-lower-compute-cost/

2.【OpenAI 为欧盟 ChatGPT 文本加入隐形水印:不藏字符,改的是选词概率】

OpenAI 于 10 月 5 日公布其应对欧盟《人工智能法案》的文本水印方案:未来数周内向欧盟地区所有套餐的 ChatGPT 与 Codex 符合条件文本逐步加入隐形水印,同时面向全球 API 客户开放水印选项(默认关闭)。技术名为 textGrain,不在文中插入隐藏字符、不可见空格或特殊标点,而是通过调整模型选词概率,在整段文字里形成人眼不可见、机器可识别的统计特征;技术报告由宾夕法尼亚大学、耶鲁大学与 OpenAI 研究者共同撰写。官方测试显示,在 1% 误报率下,200 token 段落检出率约 80%、400 token 约 95%,但把 25% 的词替换成同义词后检出率骤降至 17%,数学类内容和短文本更难检出。检测器同日开放申请,初期仅限经审核的研究者与专业机构;OpenAI 明确水印不能证明人工贡献、不能确立归属、也不能识别用户。

🔗 来源:https://www.unite.ai/openai-begins-phased-text-watermarking-under-eu-ai-act-rules

3.【何恺明团队发布 VISTA 框架:不改一个参数,ARC-AGI-3 从 40 分直接拉到 100 分】】

MIT 电气工程与计算机科学系副教授、Google DeepMind 杰出科学家何恺明团队发表论文《VISTA:面向交互世界推理的视觉框架》,不训练任何新基础模型,只在现有多模态模型外加一套视觉交互与记忆框架。在 ARC-AGI-3 的 25 个公开游戏中,Claude Opus 5 得分从 40.68 直升 100、通关全部关卡,GPT-5.6 Sol 从 13.33 升到 99。消融实验显示,仅仅把 ARC-AGI-3 的 64×64 彩色网格从"转成 4096 个数字的文本"改为直接以 PNG 图像输入,GPT-5.6 Sol 就从 13.33 涨到 47.32;再加上无损视觉记忆与主动回看机制,进一步推到 99。研究还发现图像输入更省:同样一局游戏文本版要烧掉约 7190 万 token,图像版只需约 3070 万,得分反而更高。团队同时提示,公开集成绩无法完全排除训练数据污染,严格泛化结论仍需私有测试集。

🔗 来源:https://finance.sina.cn/stock/jdts/2026-10-05/detail-iniuekzz2744725.d.html

4.【OpenAI 要把广告塞进 ChatGPT 的图像生成流程:本周起美国测试图片广告】

OpenAI 于 10 月 5 日宣布推出全新视觉广告形式,并扩展 ChatGPT 广告的衡量工具与合作伙伴生态。首个测试场景选在 ChatGPT 的图像生成过程中,广告以静态图片呈现产品灵感、使用场景或体验,清晰标注并与用户正在生成的图片保持隔离,本月晚些时候在美国面向首批广告主开放。OpenAI 强调广告不会影响 ChatGPT 的回答,广告主无法左右模型的回复内容,对话对广告主保持私密。配套动作包括接入 Hightouch、Tealium、LiveRamp 的转化数据回传,新增 AppsFlyer、Triple Whale、Adjust、Branch 等归因伙伴,以及与 DoubleVerify、Integral Ad Science 合作做品牌适配性评估试点。ChatGPT 目前周覆盖 12 亿用户,广告业务 2026 年目标收入 25 亿美元,OpenAI 计划到 2030 年将其放大 40 倍以上至逾 1000 亿美元。

🔗 来源:https://openai.com/index/new-chatgpt-ads-format-and-measurement/

5.【TikTok 推出 Buy Direct 一键结账与 AI 购物助手:把"刷到就买"压进一个会话】

TikTok 于 10 月 5 日借纽约广告周发布一整套智能体电商与广告产品,核心是站内一键结账 Buy Direct 与对话式购物助手 Shopping Assistant。Buy Direct 允许用户直接从 For You 推荐流里一键下单、不必离开 App,支持已存支付方式与收货地址、站内订单跟踪,商家仍是记录商户;Shopping Assistant 是会记上下文、记得用户需求的对话式智能体,可就产品细节、物流、尺码、库存给出实时回答并协助完成购买。两者由 Salesforce、Shopify、Shoplazza、Stripe 等电商与支付伙伴共建,需接入统一商务协议(Universal Commerce Protocol)。同批还发布了线索智能体 Agentic Leads、向美国广告主开放的 TikTok Ad Network,以及已接入 Claude、Kimi、Manus、Perplexity、Replit、Snowflake 等平台的 TikTok Ads MCP。据 eMarketer 估算,TikTok Shop 2025 年在美国实现约 158 亿美元销售额,占全美社交电商约 18%。

🔗 来源:https://techcrunch.com/2026/10/05/tiktok-rolls-out-an-ai-shopping-assistant-and-one-click-checkout/

6.【Anthropic 在印度上线境内推理:Claude 请求全部在印度服务器处理】

Anthropic 于 10 月 5 日宣布通过 Amazon Bedrock 在印度提供境内推理,Claude Opus 5、Sonnet 5、Haiku 4.5 经印度端点收到的请求全部在印度境内服务器处理。AWS 表示印度端点使用孟买与海得拉巴两地的地理跨区域推理,可在保持数据不出境的前提下调度全国算力;部署附带审计轨迹与访问控制,满足风控与合规团队的生产上线要求。该能力兑现了 Anthropic 2026 年 8 月的承诺,Reliance、CRED 等客户已在私密预览中测试,Kotak Bank、Axis Bank、IndusInd Bank、NPCI 等金融机构也在使用。Anthropic 称印度已是 Claude.ai 第二大市场,软件开发占当地工作类任务 45.2%、为各市场最高;TCS 正把 Claude 铺向 5 万名员工,Infosys 设立专门的 Anthropic 卓越中心。

🔗 来源:https://www.business-standard.com/amp/technology/artificial-intelligence/anthropic-claude-india-inference-amazon-bedrock-data-residency-126100500356_1.html

7.【Cohere 发布 North 2 企业智能体平台:把"安全、能力、成本"三选二补成三个都要】

Cohere 于 10 月 5 日发布企业智能体平台重大更新 North 2,重做多步任务编排系统,并补上管理员最关心的 token 花费上限。平台可自主推进多步任务、在需要签核的环节自动拉人进来;由一句提示词搭出的智能体可在全公司共享、跨会话保留记忆,并新增可复用的技能模块与共享素材库,连接器覆盖 Slack、GitHub、SharePoint、OneDrive,后续将接入 PitchBook、S&P Global、FactSet 等金融数据源。管理控制台 North Admin 现可把 token 用量追踪到单个用户与单个智能体,按用户和分组设定消费档位与全公司上限,并支持到达阈值前告警;平台模型无关,可挂载客户自带的第三方模型。North 2 发布距 Cohere 与德国 Aleph Alpha 签署合并协议不到三周,合并后保留 Cohere 名称。

🔗 来源:https://www.aiandtech.news/article/cohere-launches-north-2-platform-with-updated-controls

8.【OpenAI Codex 立下"28 天军令状":每天要么交一项实打实的改进,要么全量重置额度】

OpenAI 核心产品与平台负责人 Thibault Sottiaux 于 10 月 5 日在 X 上公开承诺:未来 28 天,每天要么推出"对大多数 Codex / Work 用户有明显改善且具备实际意义"的一项更新,要么为用户做一次完整额度重置。周期按发帖时间计算约从 10 月 5 日持续到 11 月 2 日。此前一天他还表示团队已"锁定方向",当前只做四件事:简化产品、提升效率以支撑更多用量、推出突破性功能、开发新模型,并坦承过去有时投入超前于产品曲线、用户反馈明确要求"更简单"。该承诺发布的背景是一连串额度争议——9 月下旬 Codex 与 Work 宕机、GPT-6 Astra 质量复盘、10 月 1 日至 3 日 GPT-6.1 Sol 带来巨大负载后对全部付费账号做了全球重置,以及 Claude Opus 5.5 在能力榜单上以 0.84 分优势超过 GPT-6 Astra。

🔗 来源:https://news.qq.com/rain/a/20261005A04NYE00

9.【Anthropic 首次下调 Opus 档价格:Opus 5.5 定为 $4/$20,比 Opus 5 便宜两成】

Anthropic 的 API 价格页于 10 月 5 日更新,最新模型阵容为 Fable 5.1($10/$50)、Claude Opus 5.5($4 输入 / $20 输出每百万 token)、Claude Sonnet 5.5($2/$10)与 Haiku 4.5($1/$5)。Opus 5.5 的定价比自 Opus 4.5 以来一贯的 $5/$25 低了 20%,是 Opus 档位首次降价,Opus 5 及更早型号维持 $5/$25 并被标为 Legacy。配套变化包括 Opus 5.5 缓存命中价降至 $0.20/百万 token、快速模式 $8/$40,Fable 5.1 缓存命中价降至 $0.25;Claude.ai Pro($17 年付)、Max($100 起)、Team 订阅价格均未调整。结合同期 OpenAI GPT-6.1 Sol 的 $2/$10,前沿模型的价格竞争正从"同代同价"转向旗舰档直接降价。

🔗 来源:https://www.usagepricing.com/blueprint/activity/anthropic-2026-10-05-opus-5-5-price-cut

10.【币安发布 Binance Intelligence:把大白话直接翻译成可执行的交易策略】

币安于 10 月 5 日通过直播发布 AI 产品栈 Binance Intelligence,由 Binance AI、Binance AI Pro 与已上线的 Binance Agent OS 三部分组成。Binance AI 对所有用户免费、10 月 5 日起逐步放开,把行情图表、新闻、社交情绪、链上数据与研究汇总进新的"For You"页,提供每 4 小时刷新的市场简报、智能工具提示与展示资深交易者仓位配置的"Master Trade"视图。真正有风险敞口的是 Binance AI Pro:用户用自然语言描述交易想法,智能体将其转成可视化、可编辑的工作流,每条策略运行在需用户手动注资的独立子账户中,资金不会逸出用户划定的范围,执行前必须人工审核,高级用户还可先做纸上交易。至此币安与 Robinhood、Coinbase 一道,都让 AI 智能体直接触碰客户资金,且三家都把决策后果留给用户自行承担。

🔗 来源:https://unbiasedheadlines.com/article/binance-launches-ai-agent-stack-for-trading-joins-robinhood-and-coinbase-in-letting-bots-place-orders

#ai  #ai行业观察  #今日AI速报

相关学习资料