GPT-5口碑两极化:编程强势领先,创作与检索表现遭质疑
OpenAI发布GPT-5后迅速引发两极评价。测试显示其在编程、逻辑推理和高级数学基准上表现突出,但在创意写作、信息检索与基础数学稳定性方面暴露短板,市场预期也随之明显波动。

OpenAI发布GPT-5后迅速引发两极评价。测试显示其在编程、逻辑推理和高级数学基准上表现突出,但在创意写作、信息检索与基础数学稳定性方面暴露短板,市场预期也随之明显波动。

OpenAI发布GPT-5后,市场评价迅速分化。测试显示其在编码、逻辑推理和部分高阶数学任务上表现突出,但在创意写作、信息检索和基础算术上暴露短板,甚至引发用户要求恢复GPT-4o。

OpenAI发布GPT-5后,凭借高数学与编程基准成绩吸引关注,但早期用户反馈分化明显。评测显示其在编程和逻辑推理上表现突出,却在创意写作、信息检索和基础算术上暴露短板。

OpenAI GPT-5发布后引发两极评价:编码和逻辑推理表现顶尖,但创意写作、信息检索惨败,甚至算错小学数学。用户愤怒请愿恢复GPT-4o,Polymarket预测OpenAI最佳模型概率从75%暴跌至12%,Google反超至80%。

OpenAI发布GPT-5后,凭借数学、编程与逻辑推理成绩吸引关注,但早期用户对其创意写作、对话体验和信息检索能力评价分化,甚至推动GPT-4o回归。

OpenAI发布GPT-5,技术测评显示其在代码与逻辑推理上表现优异,但创意写作和信息检索令人失望。用户强烈不满迫使OpenAI恢复旧版GPT-4o。预测市场上,OpenAI最佳模型概率从75%暴跌至12%,谷歌反超至80%。

Opera宣布与Google Cloud深化合作,将Aria AI助手接入Gemini模型和Imagen 2图像生成模型,为用户提供高质量文本与图像生成能力。此举标志着谷歌在浏览器AI领域直接与微软Copilot竞争,用户将拥有更多AI工具选择。

Opera宣布与谷歌云深化合作,将Gemini和Imagen 2模型集成到其浏览器AI助手Aria中,支持文本对话和图像生成。此举为用户提供谷歌AI驱动的浏览器选择,与微软Edge的Copilot和Brave的Leo形成三足鼎立。
