OpenAI测试Ultrafast推理模式,GPT-5.6 Sol输出速度最高达每秒750个Token
2026-08-14 09:52
收藏

维度网讯,8月13日,OpenAI开始向少量客户预览名为Ultrafast的高速推理模式,用于加快旗舰模型GPT-5.6 Sol的输出速度。该模式目前处于小范围测试阶段,尚未面向所有ChatGPT或API用户开放。

报道援引OpenAI的说法称,Ultrafast的处理速度最高可达到标准模式的14倍,输出吞吐量最高为每秒750个Token。其主要目标是在不切换至更小模型的情况下,提高复杂模型在实时业务场景中的响应速度。

需要区分的是,每秒750个Token主要反映模型生成文本时的输出吞吐量,不代表包含推理、工具调用、文件处理和网络检索在内的所有任务都能缩短至原来的十四分之一。不同任务的端到端速度仍会受到推理强度、上下文长度及工具执行时间影响。

TechCrunch称,Ultrafast预览由OpenAI与人工智能芯片企业Cerebras的合作提供支持,初期应用方向包括安全事件响应、客户服务、金融市场分析和电子商务等对响应延迟较为敏感的企业工作流。OpenAI计划随着计算容量增加逐步扩大访问范围。

OpenAI官方模型资料显示,GPT-5.6 Sol是GPT-5.6系列的旗舰模型,面向复杂编码、研究、计算机操作和专业工作。该模型支持105万Token上下文窗口、最高12.8万Token输出,以及从none到max的多级推理强度。Ultrafast不是独立的新模型,而是针对GPT-5.6 Sol推理服务速度的运行模式。

截至8月14日,OpenAI Docs的GPT-5.6 Sol模型页面及8月10日至14日官方产品更新摘要尚未列出Ultrafast的价格、API调用方式、服务等级、地区范围和具体开放名单。

本文来自全球互联网及战略合作伙伴信息的编译与转载,仅为读者提供交流,有侵权或其它问题请及时告知,本站将予以修改或删除,未经正式授权严禁转载本文。邮箱:news@wedoany.com