Mercury 2.5 大语言模型推理速度达到每秒 770 令牌
据简要资讯披露,大语言模型 Mercury 2.5 的推理生成性能达到了每秒 770 个令牌(tokens/s),展现出显著的高吞吐推理能力。由于原始素材信息极其有限,目前尚未公开该模型的技术架构细节、具体参数规模、测试所依托的硬件计算环境以及标准化基准测试条件,其实际应用表现和完整技术规格仍有待后续进一步详细披露。
推荐理由展示了大模型极高的推理生成速度,但缺乏底层架构与硬件环境的详细信息。
原标题:Mercury 2.5 LLM 达到每秒 770 个令牌
阅读 Buzzing HN · 中文精选 原文 ↗