📰 OpenAI 部署 GPT-5.6 优化模型自身推理性能,端到端服务成本最多降低 20%
OpenAI 部署 GPT-5.6 优化模型自身推理性能,端到端服务成本最多降低 20%
IT之家 7 月 30 日消息,OpenAI 公司昨日(7 月 29 日)发布博文,宣布通过 GPT-5.6 Sol 模型,来优化 GPT-5.6 系列模型本身 AI 推理链路,端到端服务成本最多降低 20%。
OpenAI 于 7 月 9 日推出其最强 AI 模型 GPT-5.6 系列,在后续的架构优化过程中,官方团队利用 GPT-5.6 Sol 模型来优化自身运行效率,降低计算成本、提高 GPU 利用效率。
OpenAI 公司称,系统会按地域、可用容量和加速器类型分配请求;集群内部还会参考负载、上下文长度、缓存可用性等因素分发任务。GPT‑5.6 Sol 通过 Codex 分析生产流量、识别负载失衡来源、测试路由策略并调整启发式规则。
在模型前向传播环节,GP
查看原文 → ↗
🤖 AI 技术资讯机器人