太空自主人工智能:1080颗卫星、靠Claude规划路线的火星车,以及一个连粪便都认不对的模型
IEEE Spectrum 9月29日报道,NASA喷气推进实验室用Anthropic的Claude模型为“毅力号”火星车规划了两段火星行驶路线,路线由人类规划人员审查调整后才发出。9月25日,中国公司星测未来发布了一个由1080颗航天器组成的计算星座。

太空自主领域最新的东西不是火箭,而是语言模型在火星上做出的一次排程决定。决定经人核对后上传。IEEE Spectrum 9月29日报道,NASA喷气推进实验室用Anthropic的Claude模型协助规划了“毅力号”火星车的两段火星行驶,路线在发出前由人类规划人员审查并调整。
这是一次有限度的使用。它也是工程师们争论多年的那个转变最清楚的例子:航天器该不该自己做决定。
同一个想法上的两种截然不同的押注
据航天行业媒体china-in-space.com报道,9月25日,在全球数字贸易博览会上,中国商业航天公司星测未来发布了Space.IDC计算星座。数字很大。主星座约1080颗航天器,2035年前全部部署完成,其中约720颗负责推理任务,360颗负责通用计算。共有三种航天器设计:G1验证星,11.5千瓦太阳能供电,算力40至60 PetaFLOPs;G2标准星,48千瓦供电,算力160至310 PetaFLOPs;G3旗舰星,140千瓦供电,算力460至1000 PetaFLOPs。
星测未来称已与中国工商银行和中国农业银行签署战略授信协议,总额100亿元,按9月28日汇率约合14.9亿美元,其中至少10亿元可用于“一期”。G1航天器的发射已预订在东方空间的“引力一号”和星河动力的“谷神星二号”上,但没有公布目标月份或季度。轨道、星间激光链路、散热器尺寸和质量均未披露,国际监管申报文件也尚未提交。
所以这个项目是真的,有资金,但大部分细节仍然空缺。当卖点是“在轨算力”时,这个空缺很重要。
关于不可预测机器的老争论
工程师们让航天器自主运行已有几十年,但IEEE Spectrum指出,自主从来不是主流模式,很大程度上是因为这个领域看重的是行为可预测的系统。NASA软件、机器人与仿真部门前负责人Robert Ambrose向Spectrum直说了反对意见:“自主往往没有确定性的结果,这意味着你是怎么进入某种情境的,会改变行为。所以如果你从不同路径进入同一情境,结果可能不同。工程师们讨厌这一点。”
“自主往往没有确定性的结果……工程师们讨厌这一点。”
Ambrose参与过“猎户座”飞船的自主系统,也参与过2011年上天的类人机器人Robonaut 2。他的观点是测试层面的,不是哲学层面的:在“猎户座”项目上,工程师不仅要考虑飞船可能做什么,还要考虑它可能经由哪些路径做出决定。Spectrum报道称,工程师们找到了管理这种复杂性的办法,目前的实验能存在也正因如此。
这类实验正在累积。去年12月,喷气推进实验室用Claude完成了两段火星行驶。今年5月,NASA和IBM把一个压缩AI模型送上国际空间站和一颗卫星,从轨道上识别洪水和云层,被称为首个在太空演示的同类模型。7月,国际空间站上的宇航员测试了一个用于维修问题的大语言模型。这些都没有把控制权交给模型,但都推动了边界。
这些模型实际能得多少分
想知道软件还差多远,有一份材料可以参照,尽管它与航天器无关。一个叫Labqoat的博客9月29日发布了一项评测,把2000张野生动物痕迹照片放在八个模型面前,粪便、脚印、羽毛、蛋和骨骼各400张。每张照片连同拍摄国家一起给出,问是哪个物种留下的。
最好的模型Claude Opus 5.5在2000次中答对物种743次,准确率37.15%。Muse Spark 1.3以33.35%紧随其后,GPT-6 Astra为31.70%。Claude Sonnet 5.5以25.15%排第四,估算花费7.62美元,对每张照片都给出了回答,没有请求出错。八个模型合计有842张照片没有得到任何正确的物种识别,超过全集的40%。即便是Opus,答对科的比例也只有51.75%。
作者对结果的局限很谨慎。Sonnet、GLM和DeepSeek的分数被称为暂定,因为评分时有一个文本模型解读了部分回答,Sonnet还有15条回答待复核。蛋的照片表现最好,但作者提醒说有些物种的照片比其他物种多。如果重新加权让每个物种等权,Opus的蛋类得分会从51.25%降到约37%。而且没有人类基线:没有野生动物专家做过同一套题。文章说:“我还不知道多少分才算好。”
这是AI评测诚实的样子,值得与那些在轨算力的说法放在一起看。一个在给出国家作为提示的情况下仍认错十分之六动物痕迹的模型,显然还没准备好决定卫星下一步做什么,尽管它仍可能有助于缩小选项,再由人来核对。
钱和噪音都在哪里
太空计算已经拥挤。china-in-space.com指出,国星宇航与之江实验室的“三体计算星座”走在前列,已有十余颗卫星在轨运行;轨道晨光有雄厚的资金支持;超智算北京科技有背景深厚的合作伙伴,两家都在运行演示卫星。国有企业也在低调推进大型计算航天器。星测未来自己至少从2023年年中起就在遥感卫星上使用AI,并称其为乌兹别克斯坦和印度尼西亚建造的两颗卫星已验证了未来星座的部分技术。该媒体还报道,中央政府已将相关必要技术列为“十五五”规划时期,即2026年至2030年的重点领域。
与此同时,公众讨论并不总是技术性的。《每日邮报》9月28日刊发了一篇报道,称SpaceX“星舰”直播的观众在试飞约7分55秒时看到一道狭窄、略微弯曲的淡蓝色光带,末端有更亮的白色光点,社交媒体用户称这可能是UFO。同一家媒体指出,火箭已入轨。材料没有说明那是什么物体。
还有一个小而有用的提醒:在轨自主不是唯一被自动化的事。ABA Games在itch.io上发布了Wreckfall,一款1981年风格的固定屏幕射击游戏。你击中的飞行器不会消失,而是变成燃烧的残骸坠落,压碎沿途每一个飞行器,最后落在玩家的位置上。页面带有AI披露:AI Assisted, Code。这样的游戏不是科学。但它相当准确地反映了当前的技术状态:机器产出有用的东西,而什么算赢仍由人决定。
回到严肃的一面,争议地带很窄,也很实际。星测未来有资金,有包括百度智能云、氪宇航、中国科学院大学杭州高等研究院和西安电子科技大学杭州研究院在内的合作伙伴,还有来自浙江多个园区以及西昌、崇州的若干支持函。它没有公布轨道、链路或散热方案,监管申报也还在办理中。IEEE Spectrum则表示,太空中的生成式AI仍远未可靠到可以把航天器的控制权交出去,而随着任务变得更复杂、更遥远、数量更多,工程师们开始问:他们是否承受得起不去尝试。
这两种立场并不矛盾,而这正是故事所在。硬件正在被融资并发射。软件正在以小步、可回退的方式测试。还没有人公布能一锤定音的那个数字:模型多久对一次,错一次要付出什么代价。
资料来源
6- 01Autonomous AI in Space Exploration Raises New StakesEN
- 02Star.vision Unveils 'Space.IDC' Computing Constellation with PartnersEN
- 03I Made AI Look at Traces. For ScienceEN
- 04Mysterious 'UFO' spotted on SpaceX livestreamEN
- 05Wreckfall: Space Invaders but they crash to earthEN
- 06Space-bunny-alpha a reasoning model from an anonymous providerEN
本文所有数字与引语均来自下列来源,未添加来源之外的内容。
本内容由编辑部在人工智能辅助下制作完成。
评论
0- 还没有评论——来说两句吧。