乐于分享
好东西不私藏

AI工具周报|08.17-08.23:小任务有了更便宜的主力

AI工具周报|08.17-08.23:小任务有了更便宜的主力

这周最好用的变化,是小任务有了更清楚的省钱分工:日常建站先用 Replit Free Mode,批量 API 任务排到 DeepSeek 闲时,抠图和素材拆分则交给支持透明背景的 GPT Image-2。

资讯精挑

1. Replit 推出不扣积分的日常模式

Replit 8 月 18 日发布 Free Mode,由 GPT-5.6 Luna 驱动。按官方说明,聊天、构思、日常创建和常规维护在套餐额度内不再消耗 credits;Starter、Core 和 Pro 用户都能使用,但各档可用量不同,复杂任务仍要切到付费的 Power 或 Max 模式。

这对刚学做网页的人很实际。先让它做一个单页活动页、表单或个人介绍站,跑通后再决定要不要花积分继续扩建。视频生成不在 Free Mode 里,别把“日常免费”理解成所有能力都不限量。

2. DeepSeek 周末统一按闲时价计费

DeepSeek 调整 V4 API 峰谷规则后,周六和周日全天按闲时价格计算;官方价格页显示,闲时价是高峰价的 一半。工作日按北京时间换算,高峰主要落在 09:00—12:00 和 14:00—18:00,其余时段为闲时。

批量摘要、字幕整理和离线数据清洗都可以延后到周末或夜间跑,通常比反复换模型省事。先拿同一批 10 份文档做一次成本对照,再决定是否调整定时任务。

3. DeepSeek 正式补上视觉输入

DeepSeek 8 月 21 日上线实验模型 deepseek-v4-flash-vision-exp,开始接收图片。配套 Files API 支持 JPEG、PNG、GIF 和 WebP,单文件上限 64 MiB,每个用户最多存储 25 GiB;重复使用同一张图时,可以上传一次后用 file_id 引用。

它适合先试票据提取、多张截图归纳和图表问答。社区测试中,它能关联多图信息,但也出现过看不出明显颜色错误的情况。第一次别上整套业务,拿一张发票、一个商品货架和三张流程截图做小样,逐项核对答案。

4. GPT Image-2 终于能直接交付透明底图

OpenAI 在 8 月 20 日为 GPT Image-2 API 开放透明背景预览,ChatGPT Images 也可以按指令去除或生成透明背景。API 输出应选择 PNG、WebP 或 GIF 这类支持透明通道的格式,适合商品抠图、PPT 元素拆分、贴纸和游戏素材。

这次更新主要省掉了生成后去白底、补边缘的步骤。先用一张带头发丝、玻璃或半透明包装的图片测试,重点看轮廓白边和阴影;边缘不干净,再交给传统抠图工具收尾。

5. Google 把 Antigravity 放进常用编辑器

Google 8 月 20 日推出 Antigravity IDE 扩展。VS Code 版已经可用,Visual Studio、JetBrains 和 Zed 也有对应入口或预览版。扩展能在侧栏里对话、展示逐行差异、查看执行计划,并完成多步开发任务;VS Code 版要求 1.90 或更高版本,免费档账号也能安装。

对已经习惯 VS Code 的人,这比迁移到一套新 IDE 轻松得多。安装时认准发布者 Google,第一次只让它给一个小函数补测试,再检查内联 diff 和实际测试结果,先判断它是否适合你的代码习惯。

6. Cursor 开始自己托管代码仓库

Cursor 8 月 17 日上线 Origin early beta,面向付费套餐逐步开放。首批功能包括仓库托管、代码浏览、Pull Request 和 GitHub 双向同步;从 GitHub 同步过来的项目仍以 GitHub 为数据源,评论和 PR 状态可以在两边更新。

Cursor 正在把编辑器、仓库和代码审查放到一起。已有付费账号的人可以先同步一个非关键小仓库,试一次浏览、评论和合并流程;免费用户暂时用不到,也没必要为了这个 Beta 单独升级。

AI 趣闻

1. 5600 段聊天就能训练出一个“很像自己”的模型

本周一则社区实验里,作者从 903 万条 QQ 聊天记录中筛出约 3 万条与自己有关的数据,清洗成 5600 组对话、约 103 万 Token,再训练一个 38.4M 的 LoRA。作者称三轮训练花了约 235 元,成品对口头禅和熟人语气的模仿已经很明显。

更值得看的其实是数据筛选:真正进入训练的内容只占原始记录很小一部分。想做个人风格模型,清洗“哪些话真是自己说的”,可能比继续堆聊天记录更费工夫。至于 8 张 RTX 5090,那已经不是普通人的入门配置了。

2. 死后脑组织学会让机械手模仿三个音符

一篇 6 月发布、这周被社区重新翻出的预印本,把死后成人脑组织外植体接到机械手和麦克风上。研究共使用 3 位捐献者的 30 份组织,主测试中的 16 份样本经过三天训练后,平均模仿准确率从 31.22% 提升到 58.5%;长期跟踪的 5 份样本里,有 4 份在 17 天后仍保留学习结果。

这里的“弹钢琴”其实只是识别并模仿三个音符,还远不是完整演奏。论文目前仍是未经期刊同行评审的预印本,但它确实展示了一个很怪、也很新鲜的方向:生物神经组织可以被接进闭环系统,形成新的感觉—运动关联。

3. Token 流水开始被银行拿来评估贷款

广州海珠区推出“中银·算力 Token 贷”,把企业的 Token 产出与消耗、算力服务合同、应收账款和佣金结算量纳入授信参考。产品最长三年,最高授信 3000 万元;公开信息显示,海珠支行自 7 月以来落地的相关授信已超过 2800 万元。

Token 原本只是技术账单上的一列,现在开始进入企业融资材料。不过银行看的并不是一个孤零零的 Token 数字,背后仍是合同、收入和真实业务。社区那句“Token 流水也能贷款”很抓眼球,实际逻辑没那么玄。

工具细选

1. FreeInference:研究和教学先省下一笔 API 费

FreeInference 由 Harvard SEAS 的 MadSys Lab 搭建,提供兼容 OpenAI 和 Anthropic 格式的开放模型 API,不要求绑定信用卡。哈佛邮箱可以直接开通,其他邮箱需要填写用途并等待人工审核,更适合学生、研究者和原型验证。

最小测试不用接 Coding Agent。注册后选两个开放模型,用同一段 500 字材料做摘要,记录响应时间、格式稳定性和事实遗漏。三项都过关,再把它接进自己的实验脚本。

2. NarraLume:让 AI 先提修改再由作者合并

NarraLume 是一款面向长篇小说的开源写作工作台。它把人物、时间线、伏笔和正文版本放在同一个项目里,AI 生成的文字或设定只作为候选修改,作者接受后才进入正文。网页体验版不要求先配置模型,手写、导入、导出和备份都能单独使用。

它最适合已经写了几章、开始担心人物和设定打架的人。第一次只建一本测试书:写一句故事前提、一个角色和一章大纲,再导出快照。先确认资料组织顺手,再接入模型做一段局部改写。

3. OpenLogi:给罗技外设一个轻量本地控制台

OpenLogi 是 Logitech Options+ 的本地优先替代方案,支持 macOS、Linux 和 Windows,可设置按键映射、DPI、SmartShift 与按应用切换配置,不需要账号,也不发送遥测。项目仍在快速开发,部分设备和系统功能要先查兼容列表。

它适合嫌 Options+ 太重,或者在 Linux 上缺少完整配置工具的罗技用户。先退出原厂软件,只改一个侧键并切换一次 DPI,确认睡眠唤醒和重连都正常后,再迁移整套配置。

GitHub 热榜

1. MoneyPrinterTurbo:把短视频流水线装进一个项目

harry0703/MoneyPrinterTurbo 能从主题或关键词生成脚本,匹配素材,再完成配音、字幕、背景音乐和视频合成。它有 WebUI、API、CLI 和 Agent 入口,Windows 提供一键启动包,也能在 Colab 或 Docker 里跑;本地部署需要 Python 3.11,第三方模型和语音服务可能产生费用。

它适合内容团队和想研究自动化视频流程的人,安装门槛中等。先用自有或许可素材做一条 15 秒竖屏草稿,只生成、不发布,再检查脚本、素材来源、字幕时间轴和音乐授权。

2. career-ops:把求职资料变成可追踪的工作流

santifer/career-ops 可以扫描招聘页面、按结构化标准评估岗位、针对 JD 调整简历,并跟踪申请状态。它在本地配合 Codex、Claude Code、OpenCode 等 CLI 使用,最快可通过一条 npx 命令初始化;生成 PDF 时还要安装 Playwright。

适合正在集中求职、愿意维护结构化资料的人,门槛比普通网页工具高一些。第一次只贴一个岗位描述,让它输出匹配分析,不自动填表、不批量投递,也不允许补写不存在的经历。先看判断是否靠谱,再导入更多岗位。

3. public-apis:初学者找练手接口的老牌目录

public-apis/public-apis 按天气、图书、交通、音乐等类别整理公开 API,并标注是否需要认证、是否支持 HTTPS 和 CORS。浏览目录本身几乎没有门槛,很适合刚学前端、Python 或自动化的人找真实数据源。

第一次不要挑支付、股票或复杂鉴权接口。选一个标注为 No Auth、HTTPS=Yes 的简单 API,用浏览器或 curl 请求一次,再把返回的 JSON 显示成一张卡片。能稳定拿到数据,这个小练习就完成了。

变现机会

1. 做一套电商透明底图交付包

交付物可以定为 10 张透明 PNG、3 张场景合成图和一份尺寸清单,客户优先找小店店主、闲鱼卖家或刚开始做小红书商品号的人。GPT Image-2 的透明背景能加快第一轮处理,复杂发丝、玻璃和阴影仍要人工检查。

第一步拿自己的商品或客户提供的原图做 2 张前后对比,发到本地商家群或朋友圈作品集。小试单只接 5 张图,承诺统一尺寸和一次修改,建议试单价 99—199 元,先把交付标准跑顺。

2. 卖“一个主题三条短视频”的小套餐

交付物是同一主题的 3 条 15—30 秒竖屏视频,包含脚本、字幕和封面;客户可以是本地餐饮店、培训老师或更新不稳定的知识博主。MoneyPrinterTurbo 适合搭底层流水线,人仍要负责选素材、改口播和把关成片。

先选一家熟悉的小店,用对方提供的图片做一条带水印样片,再询问是否愿意试三条不同开头。试单限定一个主题、一次修改,建议试单价 299—499 元。素材授权和发布账号都由客户确认,避免把时间耗在来回补资料上。

3. 提供三岗位的求职材料整理

交付物包括一份基础简历诊断、3 个岗位的匹配报告、3 份针对性简历和一个申请追踪表,客户适合应届生、转行者或很久没更新简历的人。career-ops 可以承担比对和排版,服务价值落在事实核验、表达取舍和岗位筛选。

第一步在校友群或求职群放一份匿名示例,免费帮一位朋友做单个 JD 匹配,换取可公开的反馈。正式小单控制在一份简历加 3 个岗位,建议试单价 199—299 元,明确不承诺面试结果,也不代替客户批量投递。

写在最后

如果这周只试一个小任务,我建议拿一张背景复杂的商品图,让 GPT Image-2 输出透明 PNG,再和你常用的抠图工具并排看边缘、阴影和文字。十五分钟就能判断,它究竟是在省时间,还是只把返工挪到了后面。

下周想看哪一个:透明商品图实测,还是 Replit Free Mode 零基础建站?

我是 AI 挑山工小李

每天帮你挑出值得关注的 AI 重点。

这里整理了一些高性价比的 AI 工具

长按识别二维码查看

【粘贴到公众号后,在这里插入二

维码图片】