Gemini Live Voice
谷歌Gemini应用中的语音对话功能,用户开口说话,应用会自动判断该调用哪个功能来处理。
简单来说
Gemini Live Voice是谷歌加入Gemini应用的语音对话功能,设想是用户只要对着麦克风说话,应用就会自动找到合适的功能来处理。可以想象一家设有多个窗口的银行:你不用自己判断该去哪个窗口,只要跟前台工作人员说明需求,对方就会带你去对的窗口。
谷歌在发布这项功能时强调,用户不需要提前琢磨自己现在要用的是聊天机器人、帮忙打理日程的助手功能,还是早晨摘要简报。也就是说,只要开口说话,应用会在背后自动分流处理。
但实际打开Gemini应用会发现,Chat、Spark、Daily Brief这三项功能仍然各自占据不同的图标和菜单位置。这也是为什么有人指出,本以为只要跟前台说一声就行,结果到了现场发现每个窗口都挂着各自的牌子,最终还是得由用户自己挑选。
在报道中是这样出现的
文章提到,"谷歌在发布新的Gemini Live Voice功能时强调,用户不必再提前猜测某项任务该用Spark还是Daily Brief。"但实际的应用界面里,Chat、Spark、Daily Brief依然是各自独立的菜单结构,这个词在此语境下被用来指出发布时的承诺与实际使用体验之间的落差。也就是说,不能仅凭"开口说话就能自动处理"的说法,就误以为它真的是一个流畅统一的界面。
亲手试一试
在Gemini应用中打开语音对话功能,试着说一句混合多种信息的请求,比如"帮我总结一下明天的日程和最近的邮件"。然后观察它是像聊天机器人那样直接回答,还是跳转到另一个界面(类似助手式摘要),这样就能大致判断这项功能实际上把不同分支整合得有多顺畅。
