AI 见闻
精选· 重要性 4/5

AI教授应对学术研究新现实:算力与资金困境

MIT Technology Review — AI··Grace Huckins·约 6 分钟阅读
中文导读

本文报道了AI学者在施密特科学AI2050项目会议上的讨论,揭示大学研究者因算力不足和资金削减而面临挑战,并探索他们如何调整研究方向以适应AI时代。

AI教授正在应对学术研究的新现实。在施密特科学AI2050项目的会议上,我看到了学术研究人员如何应对AI时代的挑战。这个故事最初出现在我们关于AI的每周通讯《算法》上。要抢先收到此类故事,请在此注册。

上周,我前往旧金山以南30英里的加州山景城一家酒店,与一些世界上最有成就、也最有前途的AI研究人员会面。我主持了圆桌访谈,并在施密特科学AI2050项目的媒体培训会上发言。该项目由埃里克·施密特和温迪·施密特资助,支持从事AI相关工作的学者。

研究员名单堪称AI名人录,尽管并非所有人都来到了湾区,但我每次转角都能遇到一位我采访过或钦佩其研究的科学家。(完全披露:我于2024年获得了施密特科学资助的科学传播奖。)

对于占AI2050群体大部分的大学AI研究人员来说,这是一个奇怪的时期。过去四年,AI研究围绕大语言模型重新定位,其前沿已从学术机构转向私营公司。

大学根本买不起训练和运行前沿模型所需的GPU,即使买得起,Anthropic和OpenAI也不会让任何人看到Claude或ChatGPT的内部细节。

在午餐交谈中,加州大学伯克利分校计算机科学教授Nika Haghtalab表示,如今的AI学者就像在一个私营公司独家控制基因编辑工具CRISPR的世界里的生物学家。

前沿实验室之外的专家可以研究ChatGPT和Claude的行为,但无法对这些工具的设计和训练进行详细研究,也无法自行引导其设计或训练。AI2050项目确实为研究员提供了一些可用于购买GPU的资金,我采访的一些研究人员表示,这是参与该项目的一大好处。

但资金仍是紧迫问题,尤其是考虑到美国联邦科学经费的削减。即使对于不自己运行本地模型的研究人员,为了严格研究而反复查询OpenAI、Anthropic和Google的模型,其成本也可能高得令人望而却步。

许多研究员没有专注于提升能力,而是将注意力集中在Anthropic或OpenAI不太可能解决的问题上。约翰·霍普金斯大学计算机科学教授Anjalie Field说:“我尽量不研究那些我认为科技公司会解决的问题。

公司需要赚钱,而那些几乎没有盈利前景的研究问题可能不值得投资——尤其是如果答案可能让公司难堪的话。例如,Field最近进行了一项研究,发现语言模型对女性比男性更常用的措辞的提示词给出的回答不够复杂。

很难想象Anthropic或OpenAI会做这样的研究。还有一大群AI学者完全不使用LLM。他们中的许多人是科学家,构建专门分析数据、做出有用预测甚至模拟整个物理系统的AI模型。

这些研究人员不一定与前沿实验室竞争——谷歌DeepMind的AlphaFold团队上个月解散了,该团队构建了预测蛋白质结构的诺贝尔奖获奖模型。但他们也面临许多自己的挑战。在会议上,一些人表达了对非LLM AI普遍被忽视如何影响他们工作的担忧。

例如,开发专门帮助应对气候变化的AI工具的研究人员,有时很难为他们的工作辩护,因为许多人认为“AI”意味着“耗电的LLM”。

所有这些挑战都在改变学术界的格局:几位著名学者最近从大学休假加入前沿实验室,许多AI2050研究员在学术工作之外还担任行业职位。在过去六个月里,又出现了另一个威胁。OpenAI的模型解决了数学领域的许多真实研究问题,一些专家担心人类在纯数学领域可能没有未来。

我采访的一位研究员说,她担心数学家同行的心理健康。但这并非全是悲观。一方面,实证科学可能比数学更难自动化,因为收集数据本质上是一个缓慢的过程。

一些研究人员将AI数学家和科学家视为福音而非威胁——包括卡内基梅隆大学的计算机科学家Tim Dettmers,他致力于让AI模型运行得更快、更便宜。Dettmers说,AI科学家不会取代人类。

相反,它们可以让人类科学家更高效,这样他和他的同行就有机会追求所有他们可能永远不会想到的疯狂而富有灵感的想法。而科学家是适应力强的群体。正是那些阻止他们训练前沿模型的资源限制,也促使他们发现新方法让模型更小、更高效,或探索全新的架构。

如果AI的下一个重大突破不是来自大公司,而是来自一个斗志旺盛的学术实验室,我不会感到震惊。深度报道:人工智能。一家初创公司声称突破了阻碍LLM的瓶颈。Subquadratic现在分享了其新模型的更多细节,但一些人仍持怀疑态度。

一个根本性缺陷使LLM极易受到攻击。它很容易诱骗它们做不该做的事,比如告诉你如何破坏飞机的导航系统。Anthropic发现了一个隐藏空间,Claude在其中思考概念。一项新技术让该公司比以往任何时候都更深入地探究LLM的怪异运作。

Claude Science是Anthropic的最新旗舰产品。该公司正加倍押注AI用于科学。保持联系:获取MIT Technology Review的最新更新,发现特别优惠、热门故事和即将举行的活动。

原文出处
AI professors are negotiating the new realities of academic research

本文为机器翻译辅以 AI 润色,仅供参考。原始事实以原文为准。

相关阅读