What is the best model for code generation?
v5 · 2026-08-244 measured options · top quality 1.000 · from $0.0232/1K requests
Which model should you use for this kind of work, and what does it cost? Below are the live-measured answers — quality, price per 1,000 requests, and latency — re-measured weekly, stated with dates and intervals, from the same measurements that route production traffic. Names that are part of the product are withheld; their numbers are not.
method: how these numbers are made · every page updates when its measurement does
4 measured options · top quality 1.000 · from $0.0232/1K requests
6 measured options · top quality 0.972 · from $0.0528/1K requests
3 measured options · top quality 0.985 · from $0.0238/1K requests
4 measured options · top quality 0.983 · from $0.0345/1K requests
3 measured options · top quality 1.000 · from $0.0042/1K requests
4 measured options · top quality 1.000 · from $0.0091/1K requests
3 measured options · top quality 0.900 · from $0.0611/1K requests
7 measured options · top quality 0.950 · from $0.3439/1K requests
3 measured options · top quality 0.982 · from $0.0058/1K requests
4 measured options · top quality 0.972 · from $0.1094/1K requests
This section is part of Frontier Notes, Potion Research's publication: the weekly issue covers what moved and what failed; these pages hold the current answers. Every claim links to its method, and negatives are published with the same prominence as wins.