AI工具每日简报|8月19日
今日热点
1. Anthropic藏着更强Model 2
风险报告披露Anthropic内部有Model 2,社区称其可能强于公开的Claude Mythos 5;Mythos 2被曝推进Mythos 3,发布时间未定,用户按公开能力选型。
2. OpenCode恢复部分DS额度
OpenCode Go将DS Flash额度恢复至30美元,仍低于此前水平;官方预告后续调整,用户按真实用量重算成本,不把临时恢复当长期承诺。
3. Qwen3.8-27B跑分亮眼
双3090跑Qwen3.8-27B Q8,社区实测8并发124.87 t/s;长上下文与vLLM可能变慢,成本也被指高于DeepSeek,本地用户需按硬件复测。
4. GPT 5.6 Sol被指过度执行
社区集中吐槽GPT 5.6 Sol过度执行、口水输出;小任务要写清范围和停止条件,逐步检查差异,避免时间与Token失控。
5. J-Space评测被质疑
J-Space提升DeepSeek V4跑分的说法遭质疑,额外提示词可能增加Token消耗;先复核数据,再比较开关插件后的真实效果。
6. 乌兰察布押注Token之都
乌兰察布已有89个数据中心并推出Token之都计划;算力投资带来增长,也引发耗水争议,评估项目要同时看能源与水资源。
AI工具动态
1. OpenRouter下调Sol API价
OpenRouter宣布GPT 5.6 Sol API费用减半,仅限API而非订阅。开发者可降调用成本,迁移前仍要比较限额、缓存、数据路径和官方价格。
2. NiceEval补齐Agent评估
NiceEval把构建评估、运行任务、查看轨迹和迭代改进串成闭环。团队可用真实失败案例建立小测试集,持续比较Agent版本。
3. OwnMem跨设备保存记忆
OwnMem用Git和Markdown保存跨设备Agent记忆,可供Claude Code、Codex等工具复用。同步前应排除密钥与隐私,并清理过期内容。
4. cc-switch新增Pi支持
CC Switch v3.20.0新增Pi Agent配置切换,可视化管理多套AI接口。切换后要核对目标地址、模型映射和密钥范围。
5. DSh修复Shell等待瓶颈
DeepSeek Harness的Shell Prompt问题被修复后,命令往返由约3600ms降至11ms。Agent终端变快,升级前后应在相同环境复测。
夜雨聆风