深度解析刚出炉的年度AI报告:一篇通晓全局
本文总结自Air Street Capital 在10月10日推出的《2024年人工智能状况报告》,也附上了一些个人点评;
4个方面的核心发现:
研究/Research
- 性能趋同: OpenAI的早期领先优势正在缩小,Claude(Anthropic公司的AI助手)和Gemini(谷歌的AI模型)等模型正在迎头赶上。”在这一年的大部分时间里,基准测试和社区排行榜都指向GPT-4与其他最佳模型之间存在显著差距。然而,Claude 3.5 Sonnet、Gemini 1.5和Grok 2(特斯拉的AI模型)已经几乎消除了这一差距,模型性能现在开始趋同”;
- 开源模型的崛起: Meta的Llama系列已显著缩小了与专有模型的性能差距。”这标志着开源模型首次缩小了与闭源前沿模型的差距”。然而,关于这些模型的真正开放性存在争议;
- 模型基准测试的挑战: 数据集污染和基准测试中的错误正在影响进展评估并引发安全担忧。”研究人员越来越多地关注数据集污染问题”。”一些最流行的基准测试中存在惊人的高错误率,这可能导致我们低估了某些模型的能力,并带来安全隐患”;
- 关注推理计算: OpenAI的o1模型展示了将计算转移到推理层以解决复杂问题的潜力,但同时使用成本也显著增加;
- 多模态和新架构: 多模态模型正在获得发展动力,同时研究人员正在探索Transformer的替代方案(当然目前transformer仍是绝对主流)和混合架构,以提高效率并解决特定任务;

