研究人员成功使用轨道上的Nvidia GPU训练AI模型,证明了太空计算的可行性。
Starcloud公司成功在一颗测试卫星搭载的英伟达H100企业级GPU上训练并运行了AI模型,该GPU于11月2日被发射到地球轨道。该公司使用这个GPU训练了NanoGPT,这是由OpenAI创始成员Andrej Karpathy创建的轻量级开源模型,并且还在该模型上进行了"推理"以生成答案和输出。此外,Starcloud还在该GPU上运行了Google的开源Gemma模型,有效地在太空中创建了一个聊天机器人。
根据Starcloud首席工程师Adi Oltean的说法,NanoGPT实现是在莎士比亚的全部作品上进行训练的。测试卫星Starcloud-1发回了一条信息,内容为:"问候,地球人!或者,按我的想法,你们是一个令人着迷的蓝色和绿色的集合。"
这一成就代表了在地球轨道上放置数据中心的早期步骤,这可能会引发新一轮太空竞赛。包括SpaceX、Google和Amazon创始人Jeff Bezos在内的主要参与者强调了潜在的好处,例如几乎无限的太阳能。在地球上,AI数据中心引发了环保问题并对电网造成了压力,使得轨道替代方案变得越来越具有吸引力。
然而,Starcloud-1仍然只是一颗卫星,大小约为一个小冰箱,搭载单个H100 GPU——远小于容纳数万个甚至数百万个GPU的地基AI数据中心。重大的技术和财务挑战横在面前,最值得注意的是在太空真空中冷却GPU的困难,太空中没有空气来散发热量。Starcloud正在探索基于空气或液体的冷却解决方案,并设想部署"太空中最大的散热器"来管理热量散发。
该公司正在准备第二颗卫星Starcloud-2,它搭载更多的GPU,计划在明年某个时间发射,最终向客户提供访问权限。正如Oltean所说:"这是将几乎所有计算迁离地球的重要第一步,以减轻我们能源供应的负担,并利用太空中丰富的太阳能。"