LLM 生命周期可视化
只构建一次。推理在每个请求上运行。
构建
数据收集与预处理
训练学习权重
评估测试质量
运维
部署打包并加载
推理每个请求都运行
优化批处理、缓存等
运行时机 构建一次,然后持续运维
衡量指标 构建时关注质量;生产中关注延迟与成本