OurCoders 科技频道关于“AI 模型与推理”的内容分类,共收录 1 篇稿件。
据 Inception 9 月 8 日公告,Mercury 2.5 已发布,新增版本提供可调推理、并行工具调用和符合 schema 的 JSON 输出。公司公布的生成速度为每秒 1,107 tokens,上下文窗口为 260K;这些是厂商披露的能力与测试口径,不是所有请求的服务保证。