Nilabas na ng Google ang Gemini 3.8 Live at Gemini 3.8 Live Extended Thinking noong September 15, at tinawag nila itong pinaka-advanced na audio models nila hanggang ngayon.
Kaya ng dalawang model na ‘to na makipag-usap, mag-reason, at gawin ang iba’t ibang tasks. Pero kumusta sila ayon sa mga independent na analyst? Ang Extended Thinking version naman ang nanguna sa Artificial Analysis’ Speech-to-Speech Index na may score na 82.6—mas mataas kesa sa GPT-Live-1 at Grok Voice.
I-follow kami sa X para lagi kang updated sa crypto balita kapag lumabas agad
Paano Rank-an ng Benchmarks ang Pinakabagong Conversational AI Model ng Google
Pinaghalo ng Artificial Analysis’ Index ang scores sa speech reasoning, agentic performance, arena preference, at task success rate.
Ang Gemini 3.8 Live Extended Thinking, na tinest gamit yung pinaka-high na reasoning effort, pumasok agad sa top spot. Sunod dito ang GPT-Live-1 Astra na may 81.5 points at Grok Voice Think Fast 2.0 High na may 81.3.
Yung standard na Gemini 3.8 Live nasa pang-lima lang ang rank na may score na 76.0. Pero pareho pa rin nila tinalo ang Gemini 3.1 Flash Live High na may 71.5 points.
Mas malaki pa yung “agentic gap.” Yung Extended Thinking nakaabot ng 68.6% sa Tau Voice benchmark, kumpara sa luma na 37.7% lang ang nakuha.
Sa speech reasoning benchmark naman, 97.7% ang nakuha ng Extended Thinking—konti lang ang lamang sa Grok Voice na 97.2%. Pero nahuli pa rin siya sa Qwen Audio 3.0 Realtime Plus, na may score na 99.2%.
Mas Pinipili Pa Rin ng Mga Tao ang Luma na Gemini Model
Malaki ang diperensya pagdating sa presyo. Yung standard model, $0.84 lang per hour ng audio input. Nasa kalahati lang ito kumpara sa $1.75 ng dati at ito pa ang pinakamura sa Index.
Yung Extended Thinking naman, $3.50 per hour. Mas mababa pa rin ito kumpara sa GPT-Live-1 Sol na $4.47 at Grok Voice Think Fast 2.0 High na $4.80.
Bumaba rin ang latency. Mula average na 2.99 seconds ng luma, naging 1.18 seconds na lang ang time to first audio ng bagong Gemini model.
Pero hindi pa rin gano’n ka-sold ang mga listener. Yung Gemini 3.1 Flash Live pa rin ang top pick based sa preference sa blind Speech Agent Arena conversations, na may Elo na 1096.
Nasa second place ang Gemini 3.8 Live na may Elo na 1083. Yung Extended Thinking variant naman, nasa 990 lang kahit natapos niya ang 89.1% ng mga assigned na tasks.
Ngayong panahon, parang may dalawang sukatan na ginagamit sa Voice AI—yung benchmark na pinaka-mahusay sa pag-reason, at yung preference na mas bet ng users makausap. Sa ngayon, Google pa rin ang nangunguna sa dalawang ‘yan—pero magkaibang model ang winner depende kung alin ang tinitingnan.
Mag-subscribe sa YouTube channel namin para mapanood ang mga crypto leader at journalists na nagbibigay ng insights at analysis









