昨天(8月17日),DeepSeek API正式调价,旗舰模型V4 Pro输出价格从6元涨到27元,涨幅350%。你如果用DeepSeek写代码、跑数据、做自动化,账单可能直接翻倍。但别急——国内还有3个模型,能力不输,价格甚至为零。
01 智谱GLM-4.7-Flash:完全免费,编程能力SOTA
GLM-4.7-Flash,智谱AI旗下完全免费模型,200K上下文,编程能力登顶SWE-Bench(59.2%),属于目前国产免费模型里最强的一档。
你不需要花一分钱,注册智谱开放平台就能直接调用。200K上下文意味着什么?一次能塞进去大约30万字,你把一整本产品文档丢进去,它都能记住上下文给你回答。
实测对比:同样一段Python爬虫代码,GLM-4.7-Flash和DeepSeek V4 Pro的输出质量几乎持平,但一个免费,一个高峰时段每百万tokens输出27元。
💡 省下来的钱,就是你多出来的利润。
怎么用:搜索”智谱AI开放平台”,注册后在API控制台找到GLM-4.7-Flash,直接调用。OpenAI兼容格式,原来用DeepSeek的代码改个接口地址就能跑。
02 通义千问Qwen3.8-Max:新用户90天免费,国产第一
Qwen3.8-Max,阿里云通义千问最新旗舰,ArtificialAnalysis全球榜单排名第五、国产第一。新用户送90天免费额度,各100万Token,足够你跑几千次调用。
通义千问最大的优势是长文本处理——1M上下文窗口,等于100万Token的一次性输入容量。你做RAG、做知识库检索、做长文档摘要,这个容量比DeepSeek V4 Pro的128K大了将近8倍。
关键数据:API调用价格方面,Qwen3.5-Flash输入0.5元/百万Token,输出1.5元/百万Token,是DeepSeek V4 Pro高峰时段的1/18。即便不走免费额度,日常成本也低到可以忽略。
怎么用:搜索”阿里云百炼”,注册后开通模型服务,选Qwen3.8-Max或Qwen3.5-Flash,同样支持OpenAI兼容接口。
03 硅基流动:9B以下模型永久免费,新用户送2000万Token
硅基流动(SiliconFlow),国内最大的模型聚合平台之一。9B以下模型永久免费,新用户赠送2000万Token,永久有效。
它的核心价值是一个接口调用所有模型——Qwen、DeepSeek、GLM、Llama,主流模型都能在它上面跑。你不需要分别注册各家平台,一个账号搞定。
实际场景:你用DeepSeek V4 Pro跑任务,高峰时段输出27元/百万Token。换成硅基流动上调用Qwen2.5-7B,永久免费,日常对话、简单文案、代码补全完全够用。复杂任务再切到GLM-4.7-Flash,还是零成本。
💡 工具不是越贵越好,是越合适越好。
怎么用:搜索”硅基流动”,注册后在模型广场选你需要的模型,API文档里有完整的调用示例。
三种替代方案,怎么选?
| 场景 | 推荐方案 | 费用 |
|:—|:—|:—|
| 代码生成/编程辅助 | GLM-4.7-Flash | 0元 |
| 长文档/知识库/RAG | Qwen3.8-Max | 0元(90天) |
| 轻量日常/多模型切换 | 硅基流动Qwen2.5-7B | 0元(永久) |
| 复杂推理/旗舰级 | GLM-5 | 4元/百万Token |
注意:DeepSeek的网页端和App端仍然免费,这次涨价只影响API调用。如果你只是日常聊天用DeepSeek,不用担心。
最后说一句:
免费不是没有好东西,是很多人没花时间去找。
如果你也在用DeepSeek API跑任务,可以先试试GLM-4.7-Flash,注册5分钟就能跑起来,零成本验证效果。
觉得有用的话,点个”关注”,顺手转发给需要的朋友。
我每周都会测一些能帮大家省钱的AI工具,别错过。
如果分享的工具和方法对你有帮助,点【喜欢作者】请作者喝杯咖啡。












暂无评论内容