🆓 免费模型优化报告 — Free Model Optimization

生成时间: 2026-08-01 16:10执行方式: 定时任务 (free-model-cleanup)目标: 自动化任务 100% 免费模型链路

将全部 LLM 驱动的 cron 任务从付费 DeepSeek 链路迁移至已验证可用的免费模型,消除自动化推理成本。

cron 任务总数

21
6 个 LLM 驱动 + 15 个脚本任务

迁移前付费任务

6
deepseek-v4-flash @ custom_DeepSeek

已迁移到免费模型

6 / 6
100% 覆盖

剩余付费 LLM 任务

0
自动化推理成本 → $0

📋 修改前后对比(6 个 LLM 任务)

任务调度修改前(付费链路)修改后(免费链路)
weekly-github-skill-scan
GitHub 生态扫描 · agent-ecosystem-scan
周五 18:00付费 deepseek-v4-flash
@custom_DeepSeek
免费 glm-4.5-air
@zhipu
sync-skill-triggers
技能触发器同步
周五 19:00付费 deepseek-v4-flash
@custom_DeepSeek
免费 glm-4.5-air
@zhipu
weekly-skills-inventory
技能库盘点
周五 20:00付费 deepseek-v4-flash
@custom_DeepSeek
免费 nvidia/nemotron-3-ultra-550b-a55b:free
@openrouter
weekly-disk-check
磁盘健康周检
周五 23:00付费 deepseek-v4-flash
@custom_DeepSeek
免费 glm-4.5-air
@zhipu
free-model-cleanup
免费模型链路清理(本任务)
周一 02:00付费 deepseek-v4-flash
@custom_DeepSeek
免费 nvidia/nemotron-3-ultra-550b-a55b:free
@openrouter
free-model-maintenance
免费模型链路维护
周一 03:00付费 deepseek-v4-flash
@custom_DeepSeek
免费 glm-4.5-air
@zhipu
ℹ️ 背景:2026-08-01 16:05 前这 6 个任务原 pin 为 deepseek-v4-pro@custom_DeepSeek(付费旗舰),当天已先降级到 flash;本次进一步整体迁移到免费链路。15 个 no-agent 脚本任务(看门狗、监控、报表生成等)不调用 LLM,无需迁移。
✅ 附带修复:free-model-cleanup / free-model-maintenance 自 2026-07-27 起因模型漂移保护(创建时 glm-4-air → 全局 deepseek-v4-pro)连续运行失败。本次改为显式 pin 免费模型后,漂移保护不再触发,两任务将于 2026-08-03 正常恢复执行。

💰 预期成本节省估算

指标deepseek-v4-pro(原始配置)deepseek-v4-flash(迁移前)免费模型(迁移后)
单次运行估算成本≈ $0.090≈ $0.019$0.000
年运行次数(6 任务 × 52 周)312312312
年化成本≈ $27.96≈ $5.99$0.00
相对迁移后年节省$27.96 / 年$5.99 / 年
📐 估算模型(明确假设,非账单数据):单次 agent 运行约 40K 输入 token(30K 缓存命中 + 10K 未命中)+ 8K 输出 token;单价假设——pro:$1.60/M(未命中)、$0.32/M(命中)、$8.00/M(输出);flash:$0.40/M、$0.08/M、$1.60/M;免费模型:$0。实际账单可能因任务复杂度和 token 用量波动,但免费链路的推理成本恒为 $0,节省比例 100%。

🧪 免费模型性能评估(实测 2026-08-01 16:06–16:12)

模型状态实测结果结论
glm-4.5-air
@zhipu
✅ 可用 HTTP 200 · 首轮延迟 13.1s · 推理型模型(reasoning_content 682 tokens)· 17×23 回答正确 (391) · finish=stop 推理能力强,适合 GitHub 扫描等复杂任务。已分配给 4 个任务(含重任务)。
nvidia/nemotron-3-ultra-550b-a55b:free
@openrouter
✅ 可用 HTTP 200 · 延迟 <5s · 17×23 回答正确 (391) · finish=stop · 认证: ~/.hermes/.env OPENROUTER_API_KEY(已验证 sk-or-v1…有效) 响应快,适合盘点/清理类轻任务。已分配给 2 个任务。免费档限额 ~50 请求/天,远够周级调度。
glm-4-air
@zhipu
❌ 不可用 HTTP 429:余额不足或无可用资源包,请充值 (code 1113) 账户无该模型免费资源包。需充值或开通资源包后方可启用(暂不分配)。
doubao-seed-1.6-lite / doubao-seed-1.6-flash
@doubao
❌ 不可用 HTTP 404:InvalidEndpointOrModel.NotFound(已测 dated / undated / 点号 三种 ID 形式) 火山引擎账号未开通这两个模型。需在控制台「开通模型」后即可加入路由。
🌐 端点连通性(model-health 守护,2026-08-01 14:56):DeepSeek 0.12s · 智谱 0.18s · 豆包 0.04s · OpenRouter 0.19s —— 四个端点全部正常。

🔧 执行详情与后续建议