7月29日,OpenAI宣布启用自研模型GPT-5.6 Sol优化GPT-5.6系列模型推理流程。该模型基于7月9日发布的GPT-5.6系列,通过Codex分析生产流量、动态调度任务,并自主重写Triton/Gluon内核,提升GPU利用率。系统依据地域、负载、上下文长度等实时分配请求;同时优化推测性解码,使token生成效率提升超15%。FpSan工具验证了内核正确性。此举使端到端服务成本最高降低20%。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。
7月29日,OpenAI宣布启用自研模型GPT-5.6 Sol优化GPT-5.6系列模型推理流程。该模型基于7月9日发布的GPT-5.6系列,通过Codex分析生产流量、动态调度任务,并自主重写Triton/Gluon内核,提升GPU利用率。系统依据地域、负载、上下文长度等实时分配请求;同时优化推测性解码,使token生成效率提升超15%。FpSan工具验证了内核正确性。此举使端到端服务成本最高降低20%。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。