从代码片段走向多文件工程任务
官方 DeepSWE 1.1 评测关注真实代码库中的长程软件工程任务,GPT-6.1 Sol 在这一评测中达到接近 Astra 的表现。对开发者而言,更适合把问题描述、相关模块和约束一起提供,让模型追踪调用关系、定位缺陷并形成跨文件修改方案。

在选型前明确容量、输入输出与调用方式。
容量与原生能力依据公开模型资料;实际请求格式、可用工具与限制以本平台对应 API 文档为准。上下文预算与最大输出应一起规划。
了解 gpt-6.1-sol 能为你的工作带来什么。
官方 DeepSWE 1.1 评测关注真实代码库中的长程软件工程任务,GPT-6.1 Sol 在这一评测中达到接近 Astra 的表现。对开发者而言,更适合把问题描述、相关模块和约束一起提供,让模型追踪调用关系、定位缺陷并形成跨文件修改方案。
官方 GDP.pdf 评测覆盖专业 PDF 中的表格、图表、示意图和细小文字,体现其文档理解方向。可用于比较规格、分析报告或提取业务字段;应用应按接口要求提供文本或图像材料,并保留能够回到原文核对的出处。
它适合把业务目标拆成相互衔接的步骤,而不只是输出一段建议。多步工具任务可使用 Responses 组织输入与结果;应用需要定义工具、管理权限并保留执行记录。模型提出行动后,应以实际工具返回判断查询、写入和核验是否完成。
从具体任务出发,找到模型发挥作用的位置。
提交明确的仓库版本、复现信息和相关模块,让模型分析修改范围与依赖,再组织补丁或重构方案。与只问一个函数相比,这类任务更能发挥它理解工程上下文的价值;最终结果仍以项目的实际运行与评审为准。
围绕规格说明、合同草稿或研究报告,要求模型回答具体问题并列出依据,或按字段整理表格内容。区分材料中的事实、推断和缺失信息,有助于把长文档分析转化为便于审核的业务结果。
在应用提供受控函数工具后,可组织查询、核对、填表和更新记录等连续流程。先定义最终记录应满足的条件,再将工具结果反馈给模型;不能把“模型计划更新”误认为系统已经完成写入。
结合任务复杂度、输入材料与预期结果选择。
6.1 Sol 的升级重点是代码、专业文档和复杂工作流,官方也报告了事实准确性改善与缓存读取成本降低。已有 Sol 应用迁移时,除了比较输出质量,还要检查推理档位和工具协议;不能仅替换 model 字符串就默认请求完全兼容。
最困难的端到端研究和高要求任务,可继续比较 Astra;边界明确的分类、提取和高频子任务,可比较 Luna。评估时同时观察完成质量、输出用量、重试和人工修订成本,模型评测成绩不能直接等同于你的生产结果。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 gpt-6.1-sol 时的常见疑问。
官方发布重点包括真实代码库任务、复杂 PDF 分析和多步骤业务流程的提升,以及更好的事实准确性与更低的官方缓存读取价格。容量相近不代表调用完全兼容,工具请求和推理档位需要按新型号核对。
应同时规划系统指令、对话历史、图像或工具信息与输出预算,不能只按原始文档长度估算。最大输出是另一项上限;接近容量边界时,优先检索相关段落,而非把不相关材料全部塞入请求。
多步工具任务可优先使用本平台的 /openai/responses,按文档配置函数定义和工具结果回传。已有 Chat Completions 应用可依照对应入口支持的函数工具格式接入;工具动作实际执行、结果核对与授权范围需由应用或托管工作流管理。
平台指南建议从 low 开始,用同一组任务比较 medium、high 或 xhigh,再为确有需要的复杂任务评估 max。更高档位应由完成质量决定,同时关注推理用量与耗时。不要沿用 none 或 minimal,并按所选接口设置 reasoning_effort 或 reasoning。
本平台计费规则区分普通输入、缓存读取、缓存写入与输出;prompt_tokens 超过 272,000 时进入长上下文档位,输入及缓存相关费率为对应基础档位的 2 倍,输出为 1.5 倍。金额以 Pricing 页和所选套餐为准;重复文本不等于已经命中缓存。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。
Input
$0.40per 1M tokens
Official $2.00
Output
$2.00per 1M tokens
Official $10.00
You pay$13,584for 142,800 credits · $0.0951 / credits
You're billed in credits. Pick a top-up tier to see its per-credit rate — the larger the top-up, the cheaper each credit.
Your API key is pre-filled in the snippet — copy and run it in your terminal or IDE.
This is only a basic call example. See the full docs for more parameters and advanced usage.