面向低延迟、高吞吐任务的轻量模型。
输入预期 token 用量,快速估算单次或批量调用成本。
同厂商或同定位模型,方便继续比较。
输入 $1输出 $6
输入 $10输出 $50
输入 $5输出 $25
输入 $2输出 $10