conv.

All stories
AIQuiet 8d · day 8

Grok launches Voice Transcribe 2.0 with doubled accuracy at same price

xAI's new speech-to-text model ranks first on the Artificial Analysis leaderboard and improves multilingual transcription.

What to know

  • Grok Voice Transcribe 2.0 achieves twice the accuracy of version 1.0 at identical pricing ($0.10/hour batch, $0.20/hour streaming).
  • The model ranks first for accuracy among 32 streaming models on the Artificial Analysis leaderboard and shows largest gains in multilingual transcription (20.6% to 6.8% error rate on short phrases).
  • xAI will make version 2.0 the default in the Speech-to-Text API in coming weeks, deprecating version 1.0.

“We've always believed the best way to move work forward is to capture context once and let it flow everywhere.”

Sanchan Saxena, SVP of Teamwork Collection at Atlassian · Investing.com ↗

xAI AI company announcing new productAtlassian Software company adopting the model

Grok launches Voice Transcribe 2.0 with doubled accuracy at same price
Investing.com News

How it unfolded 1 development · click the chart to see its coverage articlesposts

Peak 3 pieces in two hours at Sep 18, 1 PM; 3 pieces over 8 days (2 articles · 1 post) Sep 18, 1 PM — 3 pieces · 2 articles · 1 post — Newswires 2, Hacker News 1Sep 18, 3 PM — quietSep 18, 5 PM — quietSep 18, 7 PM — quietSep 18, 9 PM — quietSep 18, 11 PM — quietSep 19, 1 AM — quietSep 19, 3 AM — quietSep 19, 5 AM — quietSep 19, 7 AM — quietSep 19, 9 AM — quietSep 19, 11 AM — quietSep 19, 1 PM — quietSep 19, 3 PM — quietSep 19, 5 PM — quietSep 19, 7 PM — quietSep 19, 9 PM — quietSep 19, 11 PM — quietSep 20, 1 AM — quietSep 20, 3 AM — quietSep 20, 5 AM — quietSep 20, 7 AM — quietSep 20, 9 AM — quietSep 20, 11 AM — quietSep 20, 1 PM — quietSep 20, 3 PM — quietSep 20, 5 PM — quietSep 20, 7 PM — quietSep 20, 9 PM — quietSep 20, 11 PM — quietSep 21, 1 AM — quietSep 21, 3 AM — quietSep 21, 5 AM — quietSep 21, 7 AM — quietSep 21, 9 AM — quietSep 21, 11 AM — quietSep 21, 1 PM — quietSep 21, 3 PM — quietSep 21, 5 PM — quietSep 21, 7 PM — quietSep 21, 9 PM — quietSep 21, 11 PM — quietSep 22, 1 AM — quietSep 22, 3 AM — quietSep 22, 5 AM — quietSep 22, 7 AM — quietSep 22, 9 AM — quietSep 22, 11 AM — quietSep 22, 1 PM — quietSep 22, 3 PM — quietSep 22, 5 PM — quietSep 22, 7 PM — quietSep 22, 9 PM — quietSep 22, 11 PM — quietSep 23, 1 AM — quietSep 23, 3 AM — quietSep 23, 5 AM — quietSep 23, 7 AM — quietSep 23, 9 AM — quietSep 23, 11 AM — quietSep 23, 1 PM — quietSep 23, 3 PM — quietSep 23, 5 PM — quietSep 23, 7 PM — quietSep 23, 9 PM — quietSep 23, 11 PM — quietSep 24, 1 AM — quietSep 24, 3 AM — quietSep 24, 5 AM — quietSep 24, 7 AM — quietSep 24, 9 AM — quietSep 24, 11 AM — quietSep 24, 1 PM — quietSep 24, 3 PM — quietSep 24, 5 PM — quietSep 24, 7 PM — quietSep 24, 9 PM — quietSep 24, 11 PM — quietYesterday, 1 AM — quietYesterday, 3 AM — quietYesterday, 5 AM — quietYesterday, 7 AM — quietYesterday, 9 AM — quietYesterday, 11 AM — quietYesterday, 1 PM — quietYesterday, 3 PM — quietYesterday, 5 PM — quietYesterday, 7 PM — quietYesterday, 9 PM — quietYesterday, 11 PM — quietToday, 1 AM — quietToday, 3 AM — quietToday, 5 AM — quietToday, 7 AM — quietToday, 9 AM — quietToday, 11 AM — quiet 1
Sep 19Sep 20Sep 21Sep 22Sep 23Sep 24yesterdaynow · 1:19 PM ET
  1. 1

    Atlassian Loom integrates Grok Voice Transcribe 2.0

    Atlassian adopted Grok Voice Transcribe 2.0 for transcribing all Loom video recordings after finding it more accurate than their existing solution. The integration enables new workflows where users can record action plans in Loom and pipe transcripts directly to Cursor for automated code updates.

    “We've always believed the best way to move forward is to capture context once and let it flow everywhere.”
    — Sanchan Saxena, SVP of Teamwork Collection at Atlassian
    1. first by Investing.com News, 7d ago · also HN Frontpage

      1 more headline
  2. background

    Grok Voice Transcribe 2.0 shows specific accuracy gains across four test categories — Internal testing showed improvements across telephony (word error rate 10.6% to 7.1%), conversational audio (8.7% to 3.3%), spoken credentials (7.2% to 3.2%), and multilingual short phrases (20.6% to 6.8%). The model handles dozens of languages with automatic detection and can follow mid-recording language switches.

  3. background

    xAI releases Grok Voice Transcribe 2.0 — xAI announced Grok Voice Transcribe 2.0, a new speech-to-text model that achieves twice the accuracy of version 1.0 at the same price. The model ranks first for accuracy among 32 streaming models on the Artificial Analysis leaderboard and is built on the audio foundation model powering Grok Voice, which already handles tens of thousands of customer-support calls daily and transcribes millions of hours of video.

  4. background

    Grok Voice Transcribe 1.0 deprecation begins — xAI announced that Grok Voice Transcribe 2.0 will become the default in the Speech-to-Text API in the coming weeks, with version 1.0 deprecated. Users can pin the older version to remain on it during the transition.