人工智能评测 AI大语言模型选型实战:从豆包到DeepSeek的数学解题能力深度评测与优化方案 问题场景分析 在开发教育类应用时,我们测试了多个主流大语言模型的数学解题能力,发现两个典型问题: 豆包的随机错…