AI 基础设施
OurCoders 科技频道关于“AI 基础设施”的内容分类,共收录 57 篇稿件。
最新新闻
伯克希尔把AI机会拆成股票和电力,真正要锁定的是谁承担扩建成本
据 CNBC 9 月 5 日刊出的采访整理,伯克希尔 CEO Greg Abel 将公司的 AI 机会分成两条路径:通过 Alphabet 股票参与技术公司的价值增长,以及通过 Berkshire Hathaway Energy 为数据中心提供电力。他同时提出,服务大型云计算客户应避免抬高其他客户的电价。
别再问哪个模型推理最快,先问你站在效率前沿的哪个点
Baseten 用“效率前沿”解释大模型推理优化:一次部署很难同时把首 token 延迟、输出速度、并发吞吐、单 token 成本和模型质量都做到最好。多数优化是在几项指标间换位置,少数底层改进才会把整条边界向外推。
vLLM 0.28 不只是支持新模型,推理引擎正在变成分层存储系统
vLLM 0.28.0 合入 584 次提交,来自 270 位贡献者,其中 76 位是首次贡献。版本说明看起来像一张很长的模型支持清单,但真正改变部署方式的主线,是执行阶段拆分、权重卸载和分层 KV 缓存开始同时进入一套推理系统。
Lambda 借 10 亿美元买 GPU:这轮 AI 扩张越来越像债务生意
据 TechCrunch 援引彭博社报道,AI 云服务商 Lambda 获得 10 亿美元私人短期债务融资,用于购买 NVIDIA GPU,并计划把相关算力租给微软。Lambda 此前还完成了 10 亿美元担保信贷,并宣布一笔 9.26 亿美元贷款,用于采购 GB300 GPU、履行面向 NVIDIA 的部署合同。
数据中心要自己发电,EPA 放宽的不是所有空气污染规则
据 美国环保署 7 月发布的指导文件,不与公共电网连接、也不向电网售电的“孤岛式”发电设施,不适用《清洁空气法》下的酸雨计划。EPA 明确表示,这项解释将为数据中心建设自有发电设施提供更多空间。
OpenAI 自研 Jalapeño 推理芯片,不拆 Prefill 与 Decode 也想同时要速度和吞吐
据 OpenAI 公布的首批测试结果,其与 Broadcom 联合开发的首款定制推理芯片 Jalapeño,计划在 2026 年底开始部署进 OpenAI 自己的计算基础设施。
数据中心最隐蔽的水账单来自发电,不在机房冷却塔里
可持续发展组织 Ceres 发布报告称,美国数据中心最大的隐性用水并不发生在园区围墙内,而是在为其供电的电厂。报告分析了拥有约一半美国数据中心的七个州。
Groq 机架进入量产后,NVIDIA 开始把推理流水线拆给不同芯片
NVIDIA 表示 Groq 3 LPX 机架已进入全面量产,将与 Vera CPU 和 Rubin GPU 一起部署到云厂商 Nebius,并于今年稍晚上线。这让此前 200 亿美元资产交易从资本故事进入第一批真实交付。
德州从争抢 AI 数据中心转向全面审计,地方许可正在成为算力新瓶颈
德州州长 Greg Abbott 公开指责数据中心开发商没有争取当地支持,称行业为当前反弹“自掘坟墓”。州政府已经暂停新项目推进,并要求对 ERCOT 并网队列中的数据中心进行全面核验和审计。
Starcloud 再融 2.5 亿美元押注轨道数据中心,最大变量仍是发射能力
据 TechCrunch 报道,轨道计算初创公司 Starcloud 为今年 3 月的 1.7 亿美元 A 轮追加 2.5 亿美元扩展融资,估值 23 亿美元。Manhattan West Ventures 领投,NVIDIA、Cisco 等参投;知情人士称 NVIDIA 投入 2,500 万美元。
128GB 内存涨到 3399 美元:AI 需求正在改写普通 PC 的预算
作者:陈墨|OC 产业与资本编辑
NVIDIA 把 OpenAI 担保降到不足 1200 亿美元:风险没有消失,只是重新分配
作者:陈墨|OC 产业与资本编辑