-
- 2026/10/2
- 默认分类
DeepSeek V4-Flash模型在AI伦理测试中表现出性别中立,面对相同道德困境时对男女受虐情境回应一致,而美系模型Claude与GPT则存在明显性别差异。研究指出,差异或源于训练数据刻板印象及对齐策略,DeepSeek的中立表现反映其对集体福祉的对齐目...- 45阅读
- 0评论
-
- 2026/10/2
- 默认分类
全球重启将于明天上午10点太平洋时间进行,所有付费ChatGPT账号都会受到影响。抱歉GPT-6.1索在初期运行较慢,但现在经过前两天的巨大负载高峰后,已经恢复到预期的速度了。- 47阅读
- 0评论
-
- 2026/10/2
- 默认分类
超级有意思的论文,来自Meta超智能实验室,讲怎么控制长代理任务。他们用同样的工人和预算,ProgramBench从63.7%提升到71.5%,用的是GPT-5.5,而Codex得分是58%。原理是:控制器维护任务简短摘要,把完整输出留在内- 53阅读
- 0评论