谷歌本月为Gemini助手新增实时语音对话功能,用户可以像与真人对话一样与AI进行打断式的多轮交流。模型能够识别语气的细微变化,并支持在语音对话中同时结合画面信息作出回应。
谷歌表示,新功能基于升级后的语音模型与低延迟推理管线,对话感受更接近自然交流,而非一问一答。功能将率先在Gemini移动应用与部分智能眼镜设备上线,并逐步扩展到更多平台。
这一更新被业内视为多模态AI走向日常化的又一信号。随着语音交互愈发自然,AI助手的适用范围正从打字搜索扩展到出行、教育、老人护理等更多生活场景。
谷歌本月为Gemini助手新增实时语音对话功能,用户可以像与真人对话一样与AI进行打断式的多轮交流。模型能够识别语气的细微变化,并支持在语音对话中同时结合画面信息作出回应。
谷歌表示,新功能基于升级后的语音模型与低延迟推理管线,对话感受更接近自然交流,而非一问一答。功能将率先在Gemini移动应用与部分智能眼镜设备上线,并逐步扩展到更多平台。
这一更新被业内视为多模态AI走向日常化的又一信号。随着语音交互愈发自然,AI助手的适用范围正从打字搜索扩展到出行、教育、老人护理等更多生活场景。