Skip to content
大语言模型入门
搜索文档
K
Main Navigation
首页
LLM 指南
主题
菜单
回到顶部
本页目录
第 18 章 成本与性能考量
本章导引
大模型的实际应用不仅是技术问题,更是成本与性能的权衡问题。本章梳理大模型使用和部署的成本结构,帮助读者建立经济可行的方案。
18.1 API 调用的成本结构
[待撰写]
18.2 本地部署的成本结构
[待撰写]
18.3 性能指标
[待撰写]
18.4 成本优化策略
[待撰写]
18.5 决策框架
[待撰写]
本章小结
API 成本按 token 计费,不同模型价格差异大
本地部署的硬件和运维成本需考虑 GPU 利用率
延迟和吞吐量是核心性能指标,两者存在权衡
模型路由、缓存、量化是主要的成本优化手段
参考文献
[待补充]