conv.

← The whole story
AI
AI inference costs plunge 725-fold in 18 months, Epoch AI report shows

Tabarrok details cost decline with specific model comparison

The post highlights a concrete example: OpenAI o3 cost $0.30 per question to achieve 75% accuracy on GPQA Diamond in January 2025, while GPT-5.6 Luna achieved roughly the same score for $0.0004 in mid-2026—a 725-fold decline in under 18 months. Tabarrok argues frontier models are both smarter and cheaper to run at any performance level.

Tabarrok details cost decline with specific model comparison
marginalrevolution.com

“OpenAI o3 cost about $0.30/question to attain 75% on GPQA Diamond in January 2025, while GPT-5.6 Luna attained roughly the same score for $0.0004 in mid-2026—a roughly 725-fold decline in under 18 months.”

Alex Tabarrok

Alex TabarrokAlex Tabarrok Economist, Marginal Revolution bloggerEpoch AI Research organizationOpenAI AI company

The whole story articlespostscomments the bright band is this development · numbered dots are the others · click one to jump

Peak 4 pieces in one hour at Sep 23, 8 AM; 18 pieces over 3 days (2 articles · 2 posts · 14 comments) Sep 23, 6 AM — 1 piece · 1 article — Newswires 1Sep 23, 7 AM — quietSep 23, 8 AM — 4 pieces · 1 article · 2 posts · 1 comment — Hacker News 2, Mastodon 1, Newswires 1Sep 23, 9 AM — 4 pieces · 4 comments — Hacker News 4Sep 23, 10 AM — 4 pieces · 4 comments — Hacker News 4Sep 23, 11 AM — 4 pieces · 4 comments — Hacker News 4Sep 23, 12 PM — quietSep 23, 1 PM — quietSep 23, 2 PM — 1 piece · 1 comment — Hacker News 1Sep 23, 3 PM — quietSep 23, 4 PM — quietSep 23, 5 PM — quietSep 23, 6 PM — quietSep 23, 7 PM — quietSep 23, 8 PM — quietSep 23, 9 PM — quietSep 23, 10 PM — quietSep 23, 11 PM — quietSep 24, 12 AM — quietSep 24, 1 AM — quietSep 24, 2 AM — quietSep 24, 3 AM — quietSep 24, 4 AM — quietSep 24, 5 AM — quietSep 24, 6 AM — quietSep 24, 7 AM — quietSep 24, 8 AM — quietSep 24, 9 AM — quietSep 24, 10 AM — quietSep 24, 11 AM — quietSep 24, 12 PM — quietSep 24, 1 PM — quietSep 24, 2 PM — quietSep 24, 3 PM — quietSep 24, 4 PM — quietSep 24, 5 PM — quietSep 24, 6 PM — quietSep 24, 7 PM — quietSep 24, 8 PM — quietSep 24, 9 PM — quietSep 24, 10 PM — quietSep 24, 11 PM — quietYesterday, 12 AM — quietYesterday, 1 AM — quietYesterday, 2 AM — quietYesterday, 3 AM — quietYesterday, 4 AM — quietYesterday, 5 AM — quietYesterday, 6 AM — quietYesterday, 7 AM — quietYesterday, 8 AM — quietYesterday, 9 AM — quietYesterday, 10 AM — quietYesterday, 11 AM — quietYesterday, 12 PM — quietYesterday, 1 PM — quietYesterday, 2 PM — quietYesterday, 3 PM — quietYesterday, 4 PM — quietYesterday, 5 PM — quietYesterday, 6 PM — quietYesterday, 7 PM — quietYesterday, 8 PM — quietYesterday, 9 PM — quietYesterday, 10 PM — quietYesterday, 11 PM — quietToday, 12 AM — quietToday, 1 AM — quietToday, 2 AM — quietToday, 3 AM — quietToday, 4 AM — quietToday, 5 AM — quietToday, 6 AM — quiet 12–5
Sep 24yesterdaynow · 7:40 AM ET

Reported in the same hours no headline names this development itself — these 1 claim were published in its stretch

  1. first by HN Frontpage, 2d ago · also Marginal Revolution

What people said 1 voice · verbatim

All 5 developments of AI inference costs plunge 725-fold in 18 months, Epoch AI… →

NewswiresHacker NewsMastodon