大模型基础与技术选型1
一、不同主流模型比较1、deepseek V4开源、性价比Moe架构 支持100Wtoken 加个便宜MIT 宽松的开源协议2、GPT-5.6全能旗舰、闭源价格较贵sol\Terra\Luna分层3、Claude Opus-4.8代码和Agent能力强 长任务稳定。自适应思考根据任务复杂度调整思考量4、Qwen3国产开源标杆 中文最强模型多款模型 原生265K上下文Apache2.0的开源 支持私有化部署。5、Gemini 3.5二、面对ToB企业级知识库、C端智能助手、代码生成三类业务如何选型ToB私有化优先、中文优先。开源长文本理解准确。Qwen3 做私有化部署。 占用空间不大。// 模型路由 --- 90% 简单问题采用Qwen兜底10%复杂问题路由到更加强大的模型。ToC成本效果的均衡调用量高deepseek V4-flash、Qwen3L1: Qwen-4B 处理70%简单内容L2: Qwen-30B-A3B 处理25%中等复杂问题L3: Qwen-235B 处理5%真正复杂的推理代码生成Claude 首选、DeepSeek其次。GPT-5.6 最强最贵代码agent1函数调用稳定2多文件理解3长代码上下文