知识概念

LLM 运行与成本

语言模型产品中可测量的运行层:成本、上下文、评测、内容来源与变更管理。

5 篇当前维护的文章
01

上线前如何估算 LLM API 成本:一套可核验的 Token 预算方法

把实测的输入、缓存输入与输出 Token 转成单次请求和月度预算,再用供应商 Usage 与账单数据校准预测。

↗
02

腾讯 Hy4 preview 解析:770B 参数和 1M 上下文到底改变了什么

腾讯发布并开源 Hy4 preview。本文根据官方发布信息,梳理 770B/49B 混合专家架构、百万级上下文、接入方式、价格和开发者仍需自行验证的证据边界。

↗
03

如何构建可重复的 LLM Agent 评估

用真实任务、固定 Harness 和可审计指标,判断编程代理是否真的改善了工作,而不是只会生成漂亮回答。

↗
04

Claude 文本水印:检测能力、边界与写作者需要知道的事

Anthropic 表示未来的 Claude 模型会使用不可见的统计水印。真正重要的问题不是检测器能否标记每段文字,而是这个信号究竟能证明什么。

↗
05

OpenAI 计划停止向 Cursor 提供模型:开发者应在 11 月 12 日前准备什么

SpaceX 收购 Cursor 后,OpenAI 表示准备终止为其提供模型的合同。本文区分已确认事实与未知项,并给出降低模型供应商锁定风险的迁移清单。

↗