2026-07-05 20:09:11
GPT-5评测出炉:编码超神但数学翻车,Polymarket预测OpenAI霸主地位暴跌至12%
OpenAI GPT-5发布后引发两极评价:编码和逻辑推理表现顶尖,但创意写作、信息检索惨败,甚至算错小学数学。用户愤怒请愿恢复GPT-4o,Polymarket预测OpenAI最佳模型概率从75%暴跌至12%,Google反超至80%。
230

OpenAI GPT-5发布后引发两极评价:编码和逻辑推理表现顶尖,但创意写作、信息检索惨败,甚至算错小学数学。用户愤怒请愿恢复GPT-4o,Polymarket预测OpenAI最佳模型概率从75%暴跌至12%,Google反超至80%。

OpenAI发布GPT-5,声称是“最智能最快的模型”,在高级数学和编码基准上创下94.6%和74.9%的新纪录。然而,上线后用户反应两极:Reddit上大量批评称其“糟糕”“令人失望”,超过3000人请愿恢复旧版GPT-4o,Polymarket预测显示OpenAI最佳模型的概率从75%暴跌至12%。我们进行了全面测试,发现GPT-5在编码和逻辑推理上表现出色,API价格仅为Claude 4.1 Opus的五分之一,但在创意写作、信息检索和小学算术上严重翻车。文章详细对比了Claude、Grok和Gemini的表现,剖析了GPT-5的优缺点,并指出其更适合专业开发者而非普通用户。
