OpenAI公布GPT-5.6自进化秘籍 效率与性能双重突破。今日凌晨,OpenAI发布了四个重要消息。首先,GPT-5.6 Sol在优化生产环境GPU内核方面取得进展,使推理服务部署成本降低了20%,同时提升了token生成效率超过15%。其次,刚离职的美国AI独角兽Thinking Machines Lab联合创始人翁荔(Lilian Weng)将重新加入OpenAI,助力其开展AI自进化研究。此外,OpenAI总裁格雷格·布罗克曼透露,公司正在打造新的AI硬件,用户可能很快就能见到。最后,OpenAI用户规模首次突破10亿人,服务了200万家企业。

OpenAI还发现GPT-5.6 Sol能应对开放性难题,但在二维解谜类问题上表现不佳。研究人员通过调整API配置参数,模型在评测中的得分提高了3倍,同时输出Token消耗量减少了至原先的1/6。

为了提高模型性能,OpenAI对整个系统进行了优化,包括流量路由、任务调度、GPU内核程序、缓存机制以及模型代码实现。这些改进使得GPT-5.6系列模型在相同硬件条件下提供更多服务,保持智能性、响应速度、可用性和可靠性。例如,GPT-5.6 Sol通过优化负载均衡和推测解码技术,降低了整体端到端推理服务成本20%,并提升了Token生成效率15%以上。

ChatGPT Work和Codex依靠连续的模型调用及工具调用链路完成复杂任务。为了减少重复计算和冗余操作,研究人员设计了智能体调度基座,包括管控上下文膨胀、优化工具加载机制和复用已有计算成果。这些措施有效减少了冗余信息,简化了工作流程,并提高了整体性能。








