head-to-head

OpenAI: GPT-5.6 Luna Pro (batch) vs StepFun: Step 3.7 Flash

Side-by-side comparison of specs, pricing, benchmark scores, and task rankings. Updated 2026-08-08.

OpenAI: GPT-5.6 Luna Pro (batch) StepFun: Step 3.7 Flash
Vendoropenaistepfun
Quality Score100100
Benchmark Score-50.1
Input Price$0.10/M$0.20/M
Output Price$0.60/M$1.15/M
Context Window1,050,000262,144
Max Output128,000256,000
Tool Calling
Structured Output
Reasoning Mode
Vision
Audio--
Benchmark Scores
ai_index-51.0
ai_index_agentic-35.9
ai_index_coding-65.3

Who wins by task?

TaskOpenAI: GPT-5.6 Luna Pro (batch)StepFun: Step 3.7 Flash
SQL Generation 133 153
Code Review 132 146
Code Completion 131 130
Code Refactoring 136 144
Bug Fixing 136 155
Unit Test Generation 124 139
Code Documentation 131 133
Regex Writing 119 129
CI/CD Pipelines 120 131
Frontend Component Design 122 136
Data Analysis 124 150
CSV / Spreadsheet Cleanup 133 141
ETL Scripting 128 138
JSON Extraction 131 142
Bulk Data Labeling 129 133
OCR / Document Parsing 131 138
Table Extraction from PDFs 131 138
Long-Document Summarization 137 142
Short-Form Summarization 123 128
Blog Post Writing 121 130

Scores reflect capability match + benchmark data + pricing for each task. Methodology →

Related comparisons

Meta: Muse Spark 1.2 vs OpenAI: GPT-5.6 Luna Pro (batch) Meta: Muse Spark 1.2 vs StepFun: Step 3.7 Flash Qwen: Qwen3.8 Max vs OpenAI: GPT-5.6 Luna Pro (batch) Qwen: Qwen3.8 Max vs StepFun: Step 3.7 Flash Thinking Machines: Inkling Small vs OpenAI: GPT-5.6 Luna Pro (batch) Thinking Machines: Inkling Small vs StepFun: Step 3.7 Flash Qwen: Qwen3.7 Flash vs OpenAI: GPT-5.6 Luna Pro (batch) Qwen: Qwen3.7 Flash vs StepFun: Step 3.7 Flash