推文称开源Opus 4.8在DeepSWE基准测试中能力飞跃,并提及Qwen3.8-Max自主工作16天且成本远低于GPT-5.6 Sol和Claude Fable 5,但模型名称疑似虚构 · AIWatch