Artificial Analysis 评测 GPT-6 Sol 和 Luna:价格减半但各项表现有升有降
AI guide
AI 导读
Artificial Analysis 评测 OpenAI 的 GPT-6 Sol 和 Luna,两模型价格较 GPT-5.6 约减半,Sol 定价 $2/$10、Luna $0.10/$0.50 每百万输入/输出 token。
Story tracking
事件追踪
最新进展:GPT-6 Sol发布,在帕累托前沿新增一个点,最高配置得分48、每任务1.06美元
事件时间线
X:Artificial Analysis (@ArtificialAnlys) 一手信源
GPT-6 Sol发布,在帕累托前沿新增一个点,最高配置得分48、每任务1.06美元
本周发布的GPT-6 Sol在智能指数与任务成本帕累托前沿上新增一个点,其最高配置得分为48,每任务成本1.06美元。
阅读原始报道 ↗X:Arena (@arena) 一手信源
GPT-6 Sol (Max) 在 Code Arena: WebDev 获1689分排名第4,重塑帕累托前沿
OpenAI 的 GPT-6 Sol (Max) 在 Code Arena: WebDev 取得1689分、排名第4,并重塑了帕累托前沿,价格为每百万token 8美元(输入/输出混合)。其表现与 Claude Opus 5 (Max) 相当但成本不到一半,在帕累托上落后领先者 GPT-6 Astra (Max) 两个位次、成本为其五分之一。相比排名第17的 GPT-5.6 Sol (xHigh) 提升72分,并在全部类别中进步:Simulations 第18升至第3、Content Creation 第14升至第3、Gaming 第13升至第3、Consumer Product 第14升至第4、Reference-based design 第10升至第4、Brand & Marketing 第13升至第5、Data & Analytics 第14升至第6。
阅读原始报道 ↗Simon Willison 博客
OpenAI在Anthropic发布后约一小时发布GPT-6 Sol,定价约为GPT-5.6 Sol的一半(输入$2/M、输出$10/M)
OpenAI在Anthropic发布Claude Opus 5.5约一小时后发布GPT-6 Sol。据原文,其定价约为GPT-5.6 Sol的一半,输入$2/M、输出$10/M,作者认为该定价极具竞争力,与Grok 4.7输入价格持平、输出更接近。
阅读原始报道 ↗X:Artificial Analysis (@ArtificialAnlys) 一手信源
GPT-6 Sol以与前代相近的智能指数得分实现成本减半,成本改进来自代币定价约降50%
据 Artificial Analysis 智能指数的报道,OpenAI 的 GPT-6 Sol 在取得与 predecessor 相近得分的同时,成本较前代降低一半,成本改进主要由代币定价约50%的削减驱动。
阅读原始报道 ↗Ars Technica:AI(RSS)
OpenAI发布GPT-6 Sol:成本较前代减半,API定价为输入$2/百万、输出$10/百万token
OpenAI宣布发布GPT-6 Sol,为其聚焦效率与速度的中端模型最新版,定位为日常任务的高效实惠选择。据OpenAI,Sol采用与GPT-6 Astra相似的训练方法,在某些任务上比前代强几个百分点,但使用成本仅为一半;API定价为每百万输入token $2、输出token $10。
阅读原始报道 ↗X:Arena (@arena) 一手信源
@petergostev在相同提示词、双方最大推理的匹配条件下对比GPT-6 Sol与GPT-5.6 Sol,结果发布于YouTube
据帖文,@petergostev在匹配条件下对GPT-6 Sol与GPT-5.6 Sol做头对头对比:相同提示词、两个模型均用最大推理;对比不只看生成结果,还包括总token用量和耗时,以呈现两模型在输出、token消耗和延迟上的差异。结果和Peter的提示词可在帖文方的YouTube上找到。
阅读原始报道 ↗IT之家(RSS)
OpenAI 发布 GPT-6 Sol 模型,API 价格较 GPT-5.6 促销价降低 50%,并在 ChatGPT Work、Codex 和 API 中开放
OpenAI 发布 GPT-6 系列新模型 GPT-6 Sol,采用与 GPT-6 Astra 类似的方法训练,官方称将 Astra 的先进性能带入更快更经济的模型。其 API 价格相比 GPT-5.6 促销价降低 50%。官方公布多项成绩:AutomationBench xhigh 下优于 Claude Opus 5 且每任务成本仅为其 9%,Last Exam 得分 56.4%,DeepSWE v1.1 得分 68.8%,OSWorld 2.0 offline 得分 60.5%,事实错误率约为前代一半,并在对齐评估中相较 GPT-5.6 改进。自发布起向 ChatGPT Work 和 Codex 中的 Plus、Pro、Business、Enterprise、Edu 用户开放,暂未在 Chat 中提供,API 以 gpt-6-sol 形式提供。
阅读原始报道 ↗X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)
Perplexity宣布GPT-6 Sol向所有用户开放,并在其WANDR评估中称以五分之一价格超越Opus 5
Perplexity宣布GPT-6 Sol现已向所有Perplexity用户开放。作者称在其Wide-And-Deep-Research (WANDR)评估中,该模型以约五分之一的价格超越Opus 5。Sol将成为Computer用户“Light”努力模式的编排器,而Astra继续担任“High”努力模式的编排器。评估结果为发布方自报成绩,作者同时向OpenAI表示祝贺。
阅读原始报道 ↗X:ZHO (@ZHO_ZHO_ZHO)
GPT-6 Sol 正式发布,定位更具性价比的主力生产模型,定价$2/1M input、$10/1M output
原文报道 GPT-6 Sol 正式发布,定位为更具性价比的主力生产模型,定价为每百万输入 token 2 美元、每百万输出 token 10 美元。发布方在原文中未具名;Astra 在文中仅作为产品线中'能力上限'一档被列出。
阅读原始报道 ↗X:Greg Brockman (@gdb)
作者宣布发布GPT-6 Sol:更快、更便宜,宣称带来Astra专业工作、事实性、编码、计算机使用和对齐SOTA性能背后的进展
作者宣布发布新模型GPT-6 Sol,宣称其速度更快、价格更可负担,并带来Astra在专业工作、事实性、编码、计算机使用和对齐方面SOTA性能背后的进展。以上为公告所称,发布方在原文中未具名。
阅读原始报道 ↗X:Noam Brown (@polynoamial)
GPT-6 Sol 发布:性能优于5.6且价格降低50%
作者宣布 GPT-6 Sol 模型已发布,称其相比前代 5.6 性能更好且价格降低 50%。
阅读原始报道 ↗X:Sam Altman (@sama)
GPT-6 Sol 发布,在智能、对齐、工作产出、编码及计算机使用等方面较 5.6 系列前代有重大改进,且每 token 价格减半、每任务成本更低
GPT-6 Sol 作为新模型发布,在智能、对齐、工作产出、编码和计算机使用等方面相较其 5.6 系列前代有重大改进,同时每 token 价格减半,每任务成本更低。原文未具名发布方,也未给出具体发布日期。
阅读原始报道 ↗Hacker News 热门(buzzing.cc 中文翻译)
OpenAI改进GPT-6提示缓存:默认提高缓存命中率,缓存输入读取享90%折扣并推出监控与诊断工具
OpenAI宣布改进GPT-6的提示缓存,默认提高缓存命中率,缓存输入读取享90%折扣;新增Prompt Caching Dashboard和诊断工具,支持在不破坏缓存的情况下调整推理强度、启停工具,并可设置显式断点控制缓存前缀。据GitHub报告,过去数月这些改进使OpenAI模型数十亿请求中需重新处理的提示token占比下降超过50%,帮助Copilot更快响应。
阅读原始报道 ↗X:Tibo (@thsottiaux)
GPT-6 Sol发布,官方称全面提升且写作质量改善,API价格永久降低50%
官方宣布GPT-6 Sol模型发布,称其在各方面及写作和整体质量上有显著提升;同时该模型API价格永久降低50%,使其适用于更多用例。
阅读原始报道 ↗X:Artificial Analysis (@ArtificialAnlys) 一手信源
OpenAI发布GPT-6 Sol,价格较GPT-5.6 Sol减半至$2/$10每百万tokens;AA测试显示智力指数持平、编码代理指数57分升2分,幻觉率由92%降至60%
Artificial Analysis报道OpenAI发布GPT-6 Sol:定价约为GPT-5.6 Sol一半,每百万输入/输出tokens由$4/$20降至$2/$10,缓存读9折、写加价25%,跑智力指数每任务成本$1.06、约降50%。AA测试显示智力指数与编码代理指数(57分,升2分)整体与GPT-5.6持平,AA-Omniscience幻觉率由92%降至60%(因更常拒答,准确率由59%降至54%,指数22升至27),AutomationBench-AA与Terminal-Bench 4.0提升,但在GDPval-AA v2.1退步约100 Elo,AA-Briefcase v1.1持平。
阅读原始报道 ↗X:OpenAI Developers (@OpenAIDevs) 一手信源
Astra发布GPT-6 Sol模型,API定价比GPT-5.6低50%
Astra今日发布GPT-6 Sol模型,API定价比GPT-5.6低50%,定位为用于构建应用、走向生产环境的模型。
阅读原始报道 ↗X:OpenAI (@OpenAI) 一手信源
发布GPT-6 Sol模型:基于GPT-6 Astra技术,更快更低价支持大规模工作,API价格较GPT-5.6促销价低50%
发布公告推出新模型GPT-6 Sol。该模型建立在GPT-6 Astra的技术进展之上,将其优势带入更快、更实惠的模型,以支持大规模工作。发布方还称通过提升缓存和推理效率降低成本,Sol的API价格较GPT-5.6促销定价降低50%。
阅读原始报道 ↗Hacker News:AI 热帖
OpenAI发布GPT-6 Sol:API价格较GPT-5.6 Sol促销价降50%,即日起在ChatGPT Work、Codex及API开放(Chat暂未提供)
OpenAI宣布扩展GPT-6系列,发布GPT-6 Sol。其API输入/输出价格由GPT-5.6 Sol促销价$4/$20降至$2/$10(每百万token),即降50%;即日起面向Plus、Pro、Business、Enterprise和Edu用户在ChatGPT Work与Codex开放,API端点为gpt-6-sol,当天逐步推出,Chat中暂未提供。公布成绩称其在AutomationBench、Agents' Last Exam、DeepSWE等基准上以显著更低成本达到或超越Claude Opus 5等竞品,事实性和对齐表现较前代提升。
阅读原始报道 ↗Artificial Analysis 完整文章(网页) 一手信源
GPT-6 Sol发布:价格较GPT-5.6减半至$2/$10每百万tokens,AA评测编码代理指数升2分、幻觉率大降,但GDPval-AA回落约100 Elo点
OpenAI发布GPT-6 Sol,价格较GPT-5.6 Sol约减半(从$4/$20降至$2/$10每百万输入/输出tokens)。据Artificial Analysis评测,其智能指数与GPT-5.6持平,编码代理指数升2分至57,幻觉率从92%降至60%(部分靠更常拒答,准确率降5点),Terminal-Bench 4.0等提升,但在GDPval-AA v2.1回落约100 Elo点。
阅读原始报道 ↗