SiliconFlow vs 官方价格对照:旗舰同价、红利在 Flash 和 Qwen3 小模型
SiliconFlow vs 官方价格对照旗舰同价、红利在 Flash 和 Qwen3 小模型TL;DR用了 40 分钟梳理了 SiliconFlowSF和各家官方提供商的当前价格发现一个反常识的结论旗舰模型在 SF 和官方基本同价便宜和更贵的都集中在少数模型上。真正的价差红利在 DeepSeek-V4-Flash 和 Qwen3 中小模型要省更多得盯着官方平台的闲时段、限时折扣和免费额度。一、一个被普遍误解的常识很多人包括之前的我有个直觉聚合 API 一定比官方便宜。毕竟少了一层中间商规模化采购有议价权。但把 SiliconFlowcloud.siliconflow.cn当前的公开价与各官方平台一一对比之后这个直觉被打破了。我用 40 分钟抓了 SF 的公开价再对照各家官方平台当前公开的按量价/闲时价/折扣信息得出了本文的核心结论不是普遍便宜主流旗舰是与官方同价对齐便宜和更贵的都集中在少数模型上。具体来说有 5 类情况。二、5 类典型情况把价差讲清楚1. 同价对齐SF 官方直售价下面这些模型在 SF 调用并不省钱SF 的价值是统一 API、免多家开户模型输入 / 输出¥/百万 tokens备注Kimi-K2.7-Code6.50 / 27.00SF 与官方直售价完全一致Kimi-K2.6 (Pro)6.50 / 27.00同上MiniMax-M2.52.10 / 8.40缓存 0.21两边同价Qwen3.5 开源全系397B/122B/27B/35B≤128k 分档都一样128k 切档后两边同步GLM-5.28.00 / 28.00缓存 2.00Step-3.5-Flash同官方—LongCat-2.0原价口径5.00 / 20.00但官方有折扣见下文这些模型在 SF 调用并不省钱。SF 的价值是统一 API 格式、免多家开户、Pro 专属实例同价。2. SF 明显更便宜重点关注这一类是真正能省钱的DeepSeek-V4-Flash最大的一处价差渠道输入输出缓存命中SF¥1.00¥2.00¥0.02官方高峰¥3.00¥9.00¥0.10官方闲时¥1.50¥4.50¥0.07SF 约为官方高峰价的1/3 到 1/4.5即使按官方闲时也便宜一半。这是整个对照表里最大的一处价差——日常调用 DeepSeek-V4-Flash 应该优先 SF**。Qwen3 中小开源模型SF 也很划算模型SF官方Qwen3-32B¥1 / ¥4¥2 / ¥8Qwen3-14B¥0.5 / ¥2¥1 / ¥4Qwen3-8B免费¥0.5 / ¥2Qwen3-30B-A3B¥0.7 / ¥2.8¥0.75 / ¥38B 模型直接免费用14B/32B 也几乎是半价。中小模型场景下 SF 的优势非常明显。3. SF 更贵反向警惕有些模型在 SF 上反而更贵需要注意DeepSeek-V4-Pro渠道输入输出缓存SF¥12¥24¥1.00官方高峰¥9¥27¥0.30官方闲时¥4.5¥13.5¥0.15输入贵 33%缓存贵 3 倍。只有输出略便宜。如果业务重度用缓存或可闲时调用官方明显更划算。其他 SF 更贵的模型GLM-4.5-AirSF ¥1/¥6 vs 官方 ¥0.8/¥2输出贵 3 倍Hunyuan-A13B-InstructSF 高峰 ¥1/¥4、闲时 ¥0.8/¥3.2 vs 官方 ¥0.5/¥2贵约 60-100%LongCat-2.0SF 按官方原价 ¥5/¥20 卖但官方正在执行限时折扣 ¥2/¥8便宜 60%GLM-5.1 (Pro)≤32k 档与官方同价但≥32k 档 ¥8/¥28比官方统一 ¥6/¥24 贵缓存 ¥1.3-2.0 vs 官方 ¥0.5GLM-4.5VSF ¥1/¥6 vs 官方旧价 ¥2/¥6 输入便宜一半但官方已被 GLM-4.6V 降价到 ¥1/¥3 取代4. SF 独有 / 不可比官方已下架但 SF 仍可用的老模型DeepSeek-V3.2 / V3.1-Terminus / R1 / V3 系列、Ling-2.0 系列。官方根本没有按量 API 的Seed-OSS-36B字节只给 GPU 自部署、Hunyuan-MT-7B、PaddleOCR-VL、大量免费 Embedding/Rerankerbge 系、Qwen3-Embedding/Reranker 全家。这些场景下SF 是唯一选项**。5. 生图 / 视频类型SF官方Qwen-Image¥0.30/张¥0.25/张SF 略贵Qwen-Image-Edit¥0.30/张¥0.30/张同价Wan2.2¥2/个按秒¥0.14-0.7/秒Wan2.2 5 秒 480P 官方约 ¥0.7 更便宜1080P 反而贵量级相当但口径不同。三、选型决策矩阵把上面的分析浓缩成一份速查表按业务场景给出建议需求更优渠道原因DeepSeek-V4-Flash 日常调用SF约官方高峰 1/3 价DeepSeek-V4-Pro / 重缓存 / 可闲时官方高峰输入更便宜闲时再半价Kimi K2.7 / K2.6、MiniMax-M2.5、Qwen3.5 开源旗舰、GLM-5.2两边同价按方便程度选Qwen3-32B/14B/8B 小模型SF半价或免费LongCat-2.0官方限时折扣约为 SF 的 40%Hunyuan-A13B、GLM-4.5-Air官方SF 贵 60-300%已下架老模型、Seed-OSS-36B、免费 EmbeddingSF官方不可用或无 API四、几个隐藏成本容易被忽略只看按量价会遗漏几个关键成本项闲时段很多官方平台DeepSeek、GLM、MiniMax都有闲时半价窗口一般是凌晨或非工作时段。如果你的批量任务可以错峰调度能再砍一半成本限时折扣LongCat-2.0 当前官方有 ¥2/¥8 的限时折扣约为 SF 的 40%这种促销 SF 不会跟进免费额度LongCat 每日 5500 万 token、蚂蚁每日 50 万 token 等官方高额免费额度SF 同样不跟缓存命中价DeepSeek-V4-Pro 在官方的缓存价是 ¥0.30SF 是 ¥1.00——重度用缓存的业务渠道选择影响巨大这些软成本加起来对总账单的冲击往往超过按量价差本身。五、所以到底该怎么选把上面的所有分析总结成三条原则原则 1旗舰看方便不看价差Kimi K2.7、MiniMax-M2.5、Qwen3.5、GLM-5.2 这些旗舰模型在 SF 和官方同价选哪个纯粹看你的运维偏好——SF 是统一 API 不用到处开户官方可能有更强的 SLA 和免费的额度。原则 2DeepSeek-V4-Flash 选 SFV4-Pro 选官方这是对照表里价差最大的一组Flash 选 SF 便宜 1/3 到 1/4.5Pro 在 SF 上反而贵尤其缓存。原则 3把官方当成促销购物车官方平台的闲时段、限时折扣、免费额度是聚合 API 学不来的羊毛。如果业务可以错峰调度或接受限时模型切换把官方当主渠道、SF 当 backup 是更优策略。六、一句话总结SiliconFlow 的定价策略是旗舰模型跟随官方价、靠聚合与免费/Pro 档做差异化真正的价差红利在DeepSeek-V4-Flash和Qwen3 中小模型要省更多得盯着各官方平台的闲时、限时折扣和免费额度这些 SF 都不跟。下次有人跟你说SF 一定比官方便宜你可以把这份对照表甩过去——他会发现没那么简单。附录怎么自己核价如果你想自己核一遍当前价格SF 价格中心https://cloud.siliconflow.cn/me/models各官方价格页DeepSeekhttps://api-docs.deepseek.com/quick_start/pricing智谱 GLMhttps://open.bigmodel.cn/pricingKimi/Moonshothttps://platform.moonshot.cn/docs/pricing/chat阿里 Qwenhttps://help.aliyun.com/zh/model-studio/getting-started/modelsLongCat 美团https://longcat.chat/platform检查项输入价、输出价、缓存命中价、是否有闲时段、是否有免费额度、是否有限时折扣价差这件事每季度都会变建议每 3 个月重新核一次。关于本文这份对照表是我在为团队做 LLM 选型时的工作笔记整理成文时已根据截至 2026-08-29 的公开价核对。具体到你的业务场景建议结合实际调用量、错峰能力、缓存命中率再做精细测算。