ChatGPT 5.1、Grok 4.1、Gemini 3 Pro各個都號稱「最強模型」,為何大眾卻「超級無感」?

未署名

近期大型語言模型快速迭代,雖基準測試分數提升,然使用者體驗差異有限。觀測到模型發展趨勢已朝向功能分化,而非僅在單一通用指標上競爭,以應對不同應用場景之需求。...