比较此分享链接中的公开模型。
价格要看,但上下文上限和能力往往更决定哪个模型合适。
价格、上下文窗口、支持的任务和近期公开动态,通常最能解释实际差异。
不能。并排数据可以缩小候选范围,但质量、延迟和出错表现,得真实测试才能看出来。