最强AI模型提速14倍,实时任务等待时间大减
快多少
速度上限是每秒750个输出令牌。OpenAI把它放在实时或接近生产的任务上。语音、客户支持、商务、开发者代理、金融研究、安全响应都包含在内。
过去这类工作流不太敢用最强模型,等待时间会打断流程。现在延迟和模型智能可以放在一起要求。
背景与用途
GPT-5.6 Sol在6月发布,同场还有平衡型Terra和速度导向型Luna。整个系列7月通过ChatGPT、Codex和API全面可用。Ultrafast是Sol的一种加速运行方式。首发渠道是OpenAI API,底层由Cerebras提供支持。
OpenAI自己的开发者已经开始用它分析事件期间的日志和链路追踪。过去要跑通宵的研究周期,现在可以压缩成工作日内多次迭代。
谁能先用
访问权限目前只在一组精选客户手里。OpenAI还在评估速度提升会怎么改变现实产品、怎么扩展容量。企业可以提交工作负载、延迟要求、预期使用量等信息,进入Ultrafast等待列表。
过去前沿AI难进实时场景,主要卡在响应不够快。现在提速把这个限制往后推了一截,但产品形态会怎么变,还没有完全展开。
原文来源
9to5Mac