MIT研究:AI公司报告掩盖真实使用情况,独立平台揭示模型差异
MIT Technology Review报道,AI公司(如Anthropic和OpenAI)定期发布用户如何使用Claude和ChatGPT的报告,但研究人员指出,这些数据仅反映公司选择公开的部分,缺乏独立验证。斯坦福大学博士生Anka Reuel表示,没有独立数据能佐证这些说法。为此,AI Observatory平台聚合了近25,000条真实用户对话,覆盖七个数据集,提供未经公司过滤的使用情况。分析发现,不同模型的使用场景差异显著:Grok用户偏向新闻和政治(包括错误信息),Claude吸引程序员,Gemini用于角色扮演,ChatGPT则常被用作作业助手。这些差异在单一公司报告中无法体现。研究强调,政策制定者和研究人员基于不完整、自利的数据做决策存在风险,独立数据源对于理解AI的实际影响至关重要。