GPT 网页版降智机制疑似更新
V2ex 社区开发者反馈称,OpenAI 网页版近期调整了模型识别与降级检测机制。测试显示,直接询问模型名称时,系统返回了错误的“sol”字样;而在经典的糖果题和水杯题测试中,模型虽经历约 30 秒的思考,最终结果依然出错。这一变化意味着,OpenAI 可能修复了此前易被用户探测底层模型状态的漏洞,通过常规对话摸底模型版本的难度正在加大。对开发者和重度用户而言,模型行为的黑盒化提升了性能评估的成本,这也表明在实际测试大模型时,必须引入更严谨的自动化基准评测,难以再依赖简单的对话式探查。