巴西光伏价格上半年涨7%,推理定价工具同期登场
据pv magazine于9月26日发布的Greener分布式能源解决方案研究,2026年上半年巴西300千瓦以下光伏系统的平均价格上涨7%。

这个数字跟GPU毫无关系,却出现在同一张桌子上。2026年9月底做算力预算的人,要同时权衡硬件资本支出、电费、每token的API价格,还有一张很少能经受生产流量考验的假设表格。
本周末发布的两份最新材料从相反的两端切入这个问题:硬件和阳光要花多少钱,硬件跑起来之后token又要花多少钱。
巴西这个数字的细节
据pv magazine 9月26日报道的Greener研究,这7%的涨幅涵盖2026年1月至6月。最终系统价格从30千瓦和50千瓦装置的每瓦2.02雷亚尔(0.38美元),到2千瓦系统的每瓦3.62雷亚尔不等。2千瓦系统的均价从1月的每瓦3.44雷亚尔升至6月的每瓦3.62雷亚尔,整套系统约7200雷亚尔。300千瓦系统均价为每瓦2.40雷亚尔,约72万雷亚尔,地面安装版本升至约83.4万雷亚尔。
推高价格的是设备,不是人工。4千瓦系统的设备价格在1月至6月间上涨18.3%,从每瓦1.42雷亚尔升至每瓦1.68雷亚尔。300千瓦系统的设备价格只涨了2.0%,从每瓦1.02雷亚尔升至每瓦1.04雷亚尔;50千瓦设备从每瓦1.14雷亚尔升至每瓦1.24雷亚尔,涨幅8.8%。
需求同期走弱。新增分布式发电并网量同比下降16%,从48.8万降至41.1万;获得抵扣额的新增用电单元数量下降43%,从95.1万降至54.1万。住宅系统占新增装机容量的65%,高于2019年的39%。融资只出现在33%的集成商销售中,下降8个百分点,为所分析时期内最低。Greener的历史序列显示,4千瓦住宅系统在2017年1月为每瓦7.74雷亚尔,2026年6月为每瓦2.91雷亚尔。
一个token到底要花多少钱
9月23日,开发者Flavio Copes发布了一款推理成本计算器,想在任何人编写计费集成之前,先给一项功能算出月度账单。它用公开的API价格比较OpenAI、Anthropic、Google、xAI、Mistral、OpenRouter和Workers AI的27个模型,把日活跃用户数、每用户调用次数、输入和输出token数,以及可选的提示缓存命中率换算成估算值。
该工具明确说明了自己的局限。它不考虑批量定价、企业折扣、图像和工具附加费,也不考虑你自己搭建的任何缓存层。Copes称其输出是规划估算,不是供应商报价。所有计算都在浏览器中进行,分享链接只把输入参数编码进URL。
标价与真实成本之间的差距,正是争论最多的地方。Nexlab于9月20日发布的一项调查比较了LocalAI、exo、GPUStack、vLLM、Ollama、llama.cpp、Xinference、LiteLLM、SkyPilot等,指出缓存感知路由决定后续轮次是否落在KV或前缀缓存已经存在的那台机器上。截至9月20日获得18.1万GitHub星标的Ollama,除了在多个URL之间轮询之外没有集群方案。vLLM按实例做前缀缓存。LocalAI在2026年6月加入了分布式模式,具备libp2p发现和基于NATS的路由器,能感知显存和前缀缓存。
两者之间的差额代表集成成本,其中包括集成商的技术和运营利润。
这句话出自pv magazine所描述的Greener方法论,放在推理上同样适用:设备不是账单。
基准测试也在变贵
9月26日,StarSkirmish启动了一项基准测试:十个大模型各有一小时挂钟时间,用C++针对BWAPI 4.4.0编写一个Protoss机器人,在OpenBW上对战。GPT-6 Astra和Claude Opus 5.5被描述为在榜首功能性并列,GPT-6 Sol紧随其后,并因相对一小时运行的平均API成本更具性价比而被单独提及。
参赛阵容为50个LLM机器人(10个模型,每个跑5次)、3个演示机器人和9个人工编写的机器人,共62个参赛者。每个参赛者与其他每个参赛者对战六次,在三张地图上各两次。评分采用Elo,由所有对局一次性拟合,Stardust缩放到100,Four Gate Dragoon缩放到0。对局在Prime Intellect沙箱上通过OpenRouter运行,仅使用第一方推理。主办方表示计划延长推理时长,因为当前最先进的模型能从超过一小时的运行中获益。
这类评测的成本没有公布。黄金的价格也没有。
Tom's Hardware 9月27日报道,一位客户订购了一台定制的Kubb Fanless迷你PC,采用纯24K黄金被动散热机箱,价格约170万美元,消息引自Fanless Tech。重量从4.6磅(2.1千克)增至28.7磅(13千克)。Fanless Tech称黄金的导热性比铝好30%到50%。Tom's Hardware指出,铜更便宜,导热也更好。底层机器是一个120 x 120 x 120毫米的盒子,可选Intel Core Ultra 5 225H、Core Ultra X7 358H或AMD Ryzen AI 5 340,在Kubb.eu标价1595欧元(1822美元),无现货。
尴尬之处
这些数字没有共同的单位。每瓦雷亚尔、每百万token美元、每次基准测试运行美元、每公斤黄金美元。唯一站得住脚的比较是:四者都在同一周上涨或引发争论,而没有一个公开数字包含决定项目能否回本的成本。
对推理规划者来说,务实的做法是把缓存命中率建模进去。Copes的计算器把它当作可选项,并指出至少有一家供应商完全不提供缓存输入折扣,因此该模型的缓存率被忽略。Nexlab的调查从基础设施一侧说了同样的话:把重复的提示路由到已经持有其前缀的机器上,比用一块更便宜但要重新计算的GPU更有价值。两个来源都没有给出节省的具体数字,也没有声称能给出。把它们都当作规划输入,然后测量你自己的流量。
资料来源
5- 01PV system costs increase by 7% in Brazil in H1EN
- 02Custom 24-carat gold mini PC costs around $1.7 million, weighs nearly 29 pounds for up to 50% faster heat transferEN
- 03Inference Cost CalculatorEN
- 04StarSkirmish: a StarCraft: Brood War benchmark for LLM-written botsEN
- 05Self-hosted inference orchestrators compared: LocalAI, exo, GPUStack, Xinference, Ollama, vLLM and CoderAI (September 2026)EN
本文所有数字与引语均来自下列来源,未添加来源之外的内容。
本内容由编辑部在人工智能辅助下制作完成。
评论
0- 还没有评论——来说两句吧。