Llama Guard 4 12B 模型已从 Together AI 定价页面移除
通过 Together AI 使用 Llama Guard 4 12B ($0.20/token) 的用户需要为内容审核/安全用例寻找替代供应商或模型。
推理平台www.together.ai13 条已发布变化
通过 Together AI 使用 Llama Guard 4 12B ($0.20/token) 的用户需要为内容审核/安全用例寻找替代供应商或模型。
开发者现在可以评估 GLM-5.3 及其更快 Flash 版本之间的成本性能权衡,Flash 提供 17 倍更低的成本,但 pass@1 性能下降约 5.6 分。
www.together.ai · 另有 1 个来源报告了同一变化
为用户提供新的模型选项;GLM-5.2 仍可作为替代方案。
营销信息从 Series C 融资公告转变为模型对比焦点,表明推广策略发生转变
用户现在可以访问更新的 DeepSeek-V4 模型变体(Flash 0731、Flash),定价 $6.00-$15.00,替代旧版 R1 和 V3 系列产品。
www.together.ai · 另有 1 个来源报告了同一变化
用户现在可以访问新的 DeepSeek V4 Pro 0813 变体,输入价格更低($1.32 vs $1.74)且输出价格更高($3.96 vs $3.48),缓存令牌价格降低($0.13 vs $0.20)。
用户现可使用新的模型选项,提供标准和缓存定价等级
开发者现在可以比较不同 LLM 在编码任务中的成本效益;突出了 DeepSeek 在编码工作负载中的卓越价格性能。
为用户提供新的模型选项,使用此模型的工作负载需要考虑成本
用户现在可以通过 Together AI 的平台访问 DeepSeek V4 Flash 0731 模型,输入成本为 $0.14/MTok,缓存输入成本为 $0.03/MTok,输出成本为 $0.28/MTok。
Together AI API 用户现在可获得新的模型选项用于推理任务。
www.together.ai · 另有 1 个来源报告了同一变化
开发者现在可以在 Together AI 平台上使用 Kimi K3 模型,输入成本为 $3.00,输出成本为 $15.00,加上输入的 $0.30 缓存选项。
用户现在可以在 DeepSWE benchmark 上访问 Kimi K3 和 Claude Fable 5 模型的比较分析,基于通过率和成本效率指标来帮助决策选择哪个模型。