资讯
这个周末“首波测评”:OpenAI的GPT-6 Astra “几乎在所有方面”都表现“惊人的出色”
📋总体概括
OpenAI于9月3日发布GPT-6 Astra,48小时内遭遇早期测试者的公开压力测试。结果显示能力明显分化:在空间理解、视觉重建与自主代理任务上为迄今最强,包括逐街重建曼哈顿、24分钟重建杭州全城、一天内完成12人联机射击游戏;但写作能力被认为不及前代,独立机构Artificial Analysis记录其在GDPval-AA v2基准上下滑约80个Elo。定价为输入10美元、输出50美元每百万token,是GPT-5.6 Sol的2.5倍,Greg Brockman宣称AGI时代已到来。
⚡关键信息
- ▸OpenAI 9月3日发布GPT-6 Astra,测试者用其在Unreal Engine逐街重建曼哈顿,另一开发者24分钟重建杭州全城3D模型。
- ▸Astra自主代理能力突出:构建的生存世界中由模型独立副本驱动的角色隔夜运行后开始自发对话;巴赫风格四声部合唱创基准最高分且无声部进行错误。
- ▸独立评测机构Artificial Analysis数据显示,Astra在覆盖44种职业的经济价值基准GDPval-AA v2上下滑约80个Elo,写作能力遭多名测试者批评不如前代。
- ▸定价为每百万输入token 10美元、输出50美元,为前代GPT-5.6 Sol的2.5倍,涨幅显著。
- ▸模型已向ChatGPT Plus、Pro、Business、Enterprise用户及API、微软Azure、AWS Bedrock渠道推出,Greg Brockman在简报中宣布AGI时代到来。
🔥犀利点评
一边是曼哈顿重建和自言自语的AI角色,一边是写作倒退和Elo下滑80分,这不是全面的AGI降临,而是一次激进的资源再分配——OpenAI把算力和训练重心押在了空间智能与Agent上,赌的是下一代入口在3D世界和自主执行,而非文字。Brockman急着宣布AGI时代,与其说是技术判断,不如说是为2.5倍涨价铺路。真正值得警惕的问题是:当写作退步却要用户多付150%的费用,OpenAI到底在向谁收费、又拿什么兑现?
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 华尔街见闻 阅读全文 →