9月3日,OpenAI正式发布GPT-6 Astra模型,次日起向ChatGPT Plus、Pro、Business和Enterprise用户全面开放,同时上线API和Amazon Bedrock平台。该模型具备105万token的上下文窗口,API定价为每百万输入token 10美元、每百万输出token 50美元。
据OpenAI公布的系统卡片,GPT-6 Astra是首个在其Preparedness Framework下达到"Critical"网络安全能力阈值的大规模部署模型。模型在τ-bench工具使用基准上较前代提升约15个百分点,SWE-bench Verified从70分区间跃升至80分区间,工具调用格式错误率降低3倍。
NVIDIA CEO黄仁勋在X平台发文称"AGI has arrived",但引发学界争议,Gary Marcus批评该说法缺乏证据和定义。GPT-6 Astra的核心卖点并非推理分数的跨越式提升,而是工具调用的稳定性和多步骤任务执行可靠性。
【AICOR点评】GPT-6 Astra的真正价值不在"更聪明",而在"更可靠地干活"。工具调用错误率降低3倍,意味着十步智能体流程的端到端成功率从约40%跃升到可投产区间。这正是企业AI落地的实际瓶颈——不是模型不够智能,而是多步骤链条中每一步的微小不可靠性被指数级放大。当可靠性成为前沿模型的主战场,AI Agent从Demo走向生产的最后一道门槛正在被跨越。
版权声明 本文由 AI 辅助整理,基于公开报道转写,信息版权归原作者及原媒体所有;内容仅作行业信息分享,不构成任何投资或商业建议。
如涉版权问题,请联系 AICOR(400-601-8080 / 微信 aicor-ai),我们将在收到通知后及时处理。