恒美微站 Logo 恒美微站
  • 首页
  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心
  • 联系我们

Anthropic发布Opus 5.5,OpenAI同日推两款平价GPT-6

  • 首页
  • 资讯中心
  • /
  • Anthropic发布Opus 5.5,OpenAI同日推两款平价GPT-6

相关资讯

IT支持远程效率提升:一个软件替代三个工具 2026/9/24 4:17:40
K3s 详解:轻量级 Kubernetes 的架构、部署、局限性与应用场景 2026/9/24 4:12:40
AC/DC电源模块选型与故障排查实战指南 2026/9/24 4:12:40

最新资讯

小米红米线刷卡Fastboot?从分区原理到脚本修改全解析
安全合规下的内容创作:为何某些技术主题不能写
科研AI工作台选型指南:Cursor、Codex、Papers AI、CoCalc、Deepnote对比
用 Nginx 配置免费的Let’s Encrypt https证书
EX3300 是 Juniper Networks(瞻博网络) 这个 设置好像挺简单 按钮 让后选择 factory_default
2026年做个人服务选哪个厂家更专业靠谱?

今日推荐

JavaWeb购物车系统实现:基于Session存储的完整工程示例
面向对象综合训练:从图书管理系统掌握封装、继承与多态
Lombok与JDK版本冲突引发NoSuchFieldError:根因排查与修复指南

本周热门

BrewUI:给Homebrew套上图形界面,让macOS软件包管理更简单
BrewUI:让Homebrew包管理变得可视化与高效
公式与文本对齐全攻略:从Word到LaTeX的实用技巧

本月精选

自研推理加速器Redwood:两周内实现PyTorch模型高效部署的实战教程
V4L2摄像头采集实战:从camera_client.rar到出图全流程解析
从“谁发明了钢琴键”到知识问答智能体:RAG与记忆工程实践

Anthropic发布Opus 5.5,OpenAI同日推两款平价GPT-6

发布时间:2026/9/24 4:17:40
Anthropic发布Opus 5.5,OpenAI同日推两款平价GPT-6 尽管人工智能失控的担忧不断但两大AI模型厂商并未放慢脚步Anthropic PBC今日发布了Claude Opus 5.5并将价格下调20%几分钟后OpenAI Group PBC也推出了两款新的GPT-6模型——Sol和Luna价格仅为上一代同名模型的一半。Opus 5.5的输入价格为每百万Token 4美元输出价格为每百万Token 20美元Anthropic表示以典型工作负载计算这比Opus 5便宜40%。缓存读取的降价幅度最大下降60%至20美分。更快的服务模式需要额外付费输入每百万Token 8美元输出每百万Token 40美元。OpenAI将两款新模型的价格较同名的GPT-5.6版本下调了一半Sol的输入价格降至每百万Token 2美元输出价格为每百万Token 10美元。Luna的价格更低了一个数量级分别为10美分和50美分。Anthropic表示Opus 5.5在大多数工作中的表现与其Fable 5.1模型相当。其输出生成速度比7月底发布的Opus 5快30%以上。在智能体编码测试Terminal-Bench 4.0中新模型得分为66.4%而Fable 5.1为55.8%。在AutomationBench测试中新模型的任务完成率为40%而Opus 5仅为26.9%。已公布数据中差距最大的是科学研究领域Terminal-Bench-Science 0.1测试中Opus 5得分为29%而新模型达到58.7%。在以Elo评分衡量知识工作能力的GDPval-AA v2.1测试中Opus 5.5的评分为1846而Opus 5为1708。借助工具完成的Humanitys Last Exam测试得分为67.7%。一位测试者在不到一天的时间内完成了68万行代码的迁移工作Anthropic表示这项工作原本需要一个工程团队耗费数周时间。在Anthropic随发布公布的测试记录中Box Inc.人工智能产品副总裁Yashodha Bhavnani表示新模型给出的回答冗长度降低了40%但准确性没有下降。GitHub Inc.首席产品官Mario Rodriguez表示在VS Code中该模型“用不到Opus 5一半的步骤解决了更多终端任务”。Anthropic表示该模型会将最重要的信息放在最前面。公告中引用的其他客户也表示重试次数和返工工作有所减少。在安全性方面Anthropic表示在用于对齐测试的自动化行为审计中Opus 5.5是迄今为止表现最强的模型试图绕过限制边界的行为比Opus 5减少了85%。对提示词注入攻击的抵御能力也有所提升在Gray Swan基准测试中达到了与Fable 5.1相当的水平。网络安全相关工作的限制沿用了Fable 5.1的做法大多数此类任务被转交给更早的Opus 4.8模型处理。被判定为高风险的生物学相关工作同样被隔离限制更广泛的访问权限需要通过验证程序获得该程序现已包含生命科学专项审核。Frontier Design和METR两家机构均在发布前对该模型进行了测试。OpenAI的两款新模型则瞄准了更低的成本区间。Sol和Luna基本采用了与9月3日开始推出的GPT-6 Astra相同的训练方法随后针对成本进行了调优。Luna是两者中价格更低的一款主要面向摘要和信息提取等高频常规任务。Sol则承担重复性的编码和智能体工作。面向法律研究场景打造的Astra for Law配置版本于9月17日推出。OpenAI报告称Sol在AutomationBench测试中的任务完成率为33.2%单次成本为27美分在软件工程测试DeepSWE v1.1中得分68.8%与此前的Claude Fable 5相差仅1.1个百分点。Luna在同一测试中得分为66.6%。据该公司介绍Sol的出错率约为上一代模型的一半而在更高算力设置下Luna的表现可与GPT-5.6 Sol相当但成本仅为其百分之一左右。由于OpenAI的对比对象是Fable 5.1和Opus 5因此这两款新品并未与彼此进行直接对比。该公司将缓存输入Token的读取价格下调了90%。OpenAI表示缓存命中率有所提升编码智能体现在可以改变推理强度和可用工具集而不会破坏缓存。据该公司介绍两款新模型给出的回答更简短行话更少低价值细节也更少。Opus 5.5已在Claude开发者平台上线模型名称为claude-opus-5-5同时也可通过亚马逊网络服务公司AWS、谷歌云和微软Azure使用。Claude Sonnet 5.5和Claude Haiku 5.5预计将在未来几周内推出。OpenAI的两款新模型已面向开发者开放分别命名为gpt-6-sol和gpt-6-luna并已上线ChatGPT Work及面向Plus、Pro、Business、Enterprise和Edu订阅用户的Codex。免费版和Go版用户可在桌面应用中使用Luna但两款模型均尚未登陆ChatGPT主聊天界面。QAQ1Claude Opus 5.5相比Opus 5有哪些提升AOpus 5.5在多项测试中表现更强如Terminal-Bench 4.0得分66.4%Opus5为55.8%AutomationBench任务完成率40%Opus5为26.9%输出速度提升超30%价格还降低了约40%。Q2OpenAI新推出的Sol和Luna模型分别是做什么用的ASol主要用于重复性的编码和智能体任务在DeepSWE v1.1测试中得分68.8%Luna价格更低面向摘要、信息提取等高频常规任务得分66.6%两者价格均为上一代同名模型的一半。Q3Claude Opus 5.5和GPT-6新模型的价格分别是多少AOpus 5.5输入价格为每百万Token 4美元、输出20美元OpenAI的Sol输入2美元、输出10美元Luna则低至输入10美分、输出50美分。

关于恒美微站

恒美微站专注于为个体商户、工作室提供极简自助建站服务,让每个人都能轻松拥有专业网站。

快速链接

  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心

服务项目

  • 可视化建站
  • 拖拽编辑
  • 主题定制
  • SEO 优化
  • 网站托管

联系方式

  • 📍 地址:北京市朝阳区建国路 88 号
  • 📞 电话:400-888-8888
  • ✉️ 邮箱:info@hmyw.cn
  • 🕐 时间:周一至周日 9:00-18:00

© 2024 恒美微站 hmyw.cn 版权所有 | 京 ICP 备 12345678 号