// Halo

无需自建即可运行 Llama —— 在 Halo 上按次付费

Meta 的开源权重 Llama 模型,由独立运营者提供服务。享受开源权重,却不必承担 GPU 账单——按次付费,无需账户。

Llama 是 Meta 的开源权重模型家族,而开源权重正是它的意义所在:没有人能把这个 模型从你手中收回。问题在于,“开源”并不等于”免费运行”——总得有人握着 GPU。

在 Halo 上,这个”有人”是一个市场,而不是一家厂商。独立运营者提供 Llama 以及 另外 140 多个模型的服务,你按次付费,而不是按硬件小时数付费。

享受开源权重,不必承担 GPU 账单

自建意味着租用或购买 GPU、维持推理服务栈运转,而且无论你一天提问一次还是一千次, 都要为此付费。在 Halo 上,你以 Base 链上的 USDC 按次付费,只为实际使用的 token 买单。闲置不产生任何费用。

无需账户,无需 API 密钥

用社交账号登录并提问即可。无需向服务商注册,没有需要轮换的 API 密钥,也不必 预留银行卡。

用证明代替信任

从外部看,诚实地提供开源模型与偷偷换成更便宜的替代品是一模一样的——除非你去核验。 Halo 会核验:每个结果都附带执行统计证明,未通过的结果会被网络拒绝。

你也可以成为提供方

Llama 可以运行在人们已经拥有的硬件上。如果你有一台闲置的机器,也可以站到这个市场 的另一端——请参阅该提供什么模型与 运营者定价与收益。

也值得比较:DeepSeek 和 Qwen。

常见问题

为什么不直接自己部署 Llama?

你完全可以——权重是开放的。但自建意味着你要租用或拥有一块 GPU,维护一套推理服务栈,而且无论你是否在提问,账单都在持续产生。Halo 让你按需使用同样的开源模型,按次计价,且完全不需要运维。

有哪些 Llama 模型可用?

运营者提供 Llama 系列中的模型,可用情况会随他们上线而变化。应用中会显示任意时刻实际正在提供的模型,因此你看到的永远不是一份过时的清单。

我怎么知道运营者运行的是真正的 Llama,而不是更小的模型?

每个结果都附带执行统计证明。真实模型会与验证器产生约 90% 以上的 token 分布重合度;替代品或伪造输出看起来就像噪声,会被网络拒绝。

这比托管 API 更便宜吗?

通常是的,因为是众多独立运营者为每个请求竞价,而不是由单一厂商定一个价。而且你严格按次付费,没有最低消费,也不必为闲置的 GPU 时间买单。