谷歌近日宣布推出其 Gemini 家族语音转文字模型的最新版本 —— Gemini 3.5 Transcribe。谷歌表示,这是该系列迄今为止精度最高的语音识别模型。新模型在处理背景噪音和复杂专业术语方面表现更为出色。同时,开发者也可利用该模型打造语音智能体、实时字幕工具或通话后分析系统。
简鹿视频转换器 -简单高效的全能视频转换器