A Google bejelentette a Gemini 3.5 Transcribe beszédfelismerő modellt

A Google bejelentette a Gemini 3.5 Transcribe modellt, amelyet a cég eddigi legpontosabb speech-to-text (beszédből szöveg) megoldásaként pozicionál. A modell a hagyományos beszédfelismerőknél pontosabban kezeli a háttérzajt, a szakzsargont és a spontán beszédben előforduló hibákat — a nyers audiot közvetlenül formázott, tiszta szöveggé alakítja. Két API-n érhető el: a Live API valós idejű, kétirányú streamelést […]