OC

Hetzner 试水 LLM 推理:低价云厂商想把开放模型也做成基础设施商品
科技 · 2026-07-25 · AI 基础设施 · 阅读 7

Hetzner 试水 LLM 推理:低价云厂商想把开放模型也做成基础设施商品

作者:陈墨|OC 产业与资本编辑

作者 陈墨 陈墨

欧洲云厂商 Hetzner 正在实验一项 LLM 推理服务,通过兼容 OpenAIAPI 提供开放权重模型。根据 Sliplane 创始人的第三方试用,服务目前免费、没有 SLA、没有生产可用性保证,也只有一个模型。

一句话结论:这还不是 Hetzner 正式进入模型云市场,但它验证了一条可能的路线:当模型权重和 API 格式都趋于标准化,推理服务可以像廉价服务器一样靠运营效率竞争。

实验提供的是 Qwen/Qwen3.6-35B-A3B-FP8,一个总参数约 350 亿、每次激活约 30 亿参数的混合专家模型,支持文本和图像、约 26.2 万 token 上下文,并使用 FP8 权重量化。开发者可以从实验控制台获取令牌,再把现有 OpenAI 客户端指向 Hetzner 的接口。

试用者在 7 月 23 日进行的小规模测试,七次短请求的首 token 位延迟为 153 毫秒,五次较长生成的输出速度约为每秒 224 token。但这只是单一客户端、单一时点的少量请求,不是并发基准或服务承诺。模型在测试还答错了两道简单算术题。

标准API让开放模型推理供应商可以切换

真正值得观察的不是当前模型,而是 Hetzner 的成本结构。开放权重模型允许不同厂商运行相同软件,OpenAI 兼容接口又降低了迁移成本,供应商很难长期依靠模型独占获得高毛利。优势将来自更低的硬件采购成本、更高的 GPU 利用率和更有效的数据心运营。

Hetzner 具备低价裸金属服务器和欧洲数据心经验,但公开 GPU 产品主要是 20GB 的 RTX 4000 SFF Ada 和 96GB 的 RTX PRO 6000 Blackwell Max-Q,并非训练和运行超大模型常见的 B200/B300 高密度集群。实验接口背后使用何种硬件,Hetzner 也没有公开。

陈墨认为,Hetzner 的潜在机会不是挑战前沿闭源模型,而是把小型开放模型做成低利润、高利用率的基础设施。如果后续出现计费、SLA、更多模型和企业数据条款,这项实验才会从有趣入口变成真实云业务。

关键事实

  • 来源:Sliplane 第三方试用
  • 涉及公司:Hetzner
  • 当前模型:Qwen3.6-35B-A3B-FP8
  • 服务状态:实验阶段,无计费、无 SLA、无生产保证

OC 判断

现在不能用一次速度测试判断 Hetzner 已具备推理竞争力。更关键的信号是它是否建设更大 GPU 集群、公布稳定计费,并把欧洲数据驻留和低价运营转化为可持续产品。

为什么重要

  • 对开发者:兼容 OpenAI 的接口降低了测试和切换开放模型供应商的成本。
  • 对企业:实验服务不适合生产负载,仍需等待 SLA、安全和数据处理条款。
  • 对市场:低价云厂商进入后,标准开放模型的推理利润可能继续被压缩。

参考来源

相关阅读

基于标题、摘要和正文内容自动匹配。

更多科技

评论

围绕这篇文章补充信息、提出问题或分享观察。

0
暂无评论。

发表评论

继续看看 OC 用户围绕这个话题说了什么、做了什么。

相关碎碎念

更多

正在做OC产品频道,支持独立开发者提交自己的app,网站,在OC得到宣传和外链。基础功能已经实现,还有一堆在路上。我们独特的是有一个能力让你把产品的用户写的文章视频也可以列在你的产品页下方。方便更多用户了解,这不是想替代你自己的产品页面,而是帮你把做每个产品页各种复杂的互动都自动化,这个产品页还是可以导流到你自己的产品页的

tinyfool 1 2

最近越来越多思考,我们跟agent的关系,比如我最近用blender mcp很多,基本上我算是会用blender的,但是老记不住很多热键,以前我可以做很复杂的模型,但是要是不是的去查blender的操作热键。现在我完全不参与模型的建模,只让codex帮我生成。 但是我还是在查blender的热键,我现在需要的是numpad .这样聚焦到一个对象的方法,我需要的是numpad /这样的方法来把除了选中的对象,其他都隐藏的热键。 换言之,我现在需要高效的人工视觉复检blender mcp的成果,这是我对自己目前blender能力的需求了。

tinyfool 2 0

从有这个想法,在OC做一个碎碎念 https://x.com/tinyfool/status/2084451008298791131 到做好,https://x.com/tinyfool/status/2084490288681386154 总共花了几个小时,Codex让讨论变得没价值,有想法就先做出来,上线看看,好用就留下,没价值再说,讨论is cheap,let's use ai make it to try

tinyfool 1 0

相关帖子

更多

你们的Codex额度提前耗完了没?戒断反应如何?

<p>我在第三天就消耗了只剩1%,忍了一天,然后今天干脆用这最后的1%,开着5.6 Sol 极高 强推我一个提示词笔记本应用的功能落地。最终用时3小时,居然还是跑完了。但是现在还是出现一些戒断反应,感觉啥也做不了,就无精打采的,困。</p> <p>我做了一个Prompt Notebook,专门用来收藏或者记录自己手搓的生图提示词。带Chrome一键收藏插件。支持AI优化提示词。支持提示词中提取常用字段作为提示词百科词汇。也自带生图功能用来测提示词。但是要搭配Cloudflare R2+Worker的图床。</p> <p>今天主要是做一个AI模特的资产库。将常用的AI模特固定下来,进行身份设定,以及模特的一些角色定妆图。之后生图可以直接调用AI模特自动作为垫图。</p> <p>这是AI模特资产库的界面: <img src="/upload/thread/202608/42b5f73e-938f-45de-b74e-da69da9d72a8.webp" alt="1bb0d28b-c7dd-4327-bafa-26b60323cbed" /> 这是主界面的提示词瀑布流,支持关键词或标签搜索: <img src="/upload/thread/202608/3e15b6e7-345f-48b4-aeff-1bbd89afe9d3.webp" alt="ab998e2f-9ccc-4173-832f-223aa6c6fa81" /> 这是提示词笔记的预览界面,可以复制提示词,分享提示词,点击分享还有分享短链:(https://prompt.jintao.co.uk/share/20260806LfsmY) <img src="/upload/thread/202608/bab31972-0468-4582-b873-6309233254a6.webp" alt="20260806-201213" /> 可惜现在没额度了,我又不想换模型折腾。现在还有些界面细节和小功能需要落地完善,可能还要虫子要抓。弄好了,打算放GitHub开源。</p> <p>有朋友想试试的么?</p>

shynloc 2 4

你为什么不移民?

<p>我是一定要移了,在这里连正常呼吸都不行了。以前正常呼吸指的是言论自由,现在是生物学意义的正常呼吸问题了。</p> <p>你为什么不移民?</p>

tinyfool 740 15