OpenAI公布GPT-5.6自進化秘籍 效率與性能雙重突破。今日凌晨,OpenAI發布了四個重要消息。首先,GPT-5.6 Sol在優化生產環境GPU內核方面取得進展,使推理服務部署成本降低了20%,同時提升了token生成效率超過15%。其次,剛離職的美國AI獨角獸Thinking Machines Lab聯合創始人翁荔(Lilian Weng)將重新加入OpenAI,助力其開展AI自進化研究。此外,OpenAI總裁格雷格·布羅克曼透露,公司正在打造新的AI硬件,用戶可能很快就能見到。最后,OpenAI用戶規模首次突破10億人,服務了200萬家企業。

OpenAI還發現GPT-5.6 Sol能應對開放性難題,但在二維解謎類問題上表現不佳。研究人員通過調整API配置參數,模型在評測中的得分提高了3倍,同時輸出Token消耗量減少了至原先的1/6。

為了提高模型性能,OpenAI對整個系統進行了優化,包括流量路由、任務調度、GPU內核程序、緩存機制以及模型代碼實現。這些改進使得GPT-5.6系列模型在相同硬件條件下提供更多服務,保持智能性、響應速度、可用性和可靠性。例如,GPT-5.6 Sol通過優化負載均衡和推測解碼技術,降低了整體端到端推理服務成本20%,并提升了Token生成效率15%以上。

ChatGPT Work和Codex依靠連續的模型調用及工具調用鏈路完成復雜任務。為了減少重復計算和冗余操作,研究人員設計了智能體調度基座,包括管控上下文膨脹、優化工具加載機制和復用已有計算成果。這些措施有效減少了冗余信息,簡化了工作流程,并提高了整體性能。




