0
并行地说与做
言语开始产生约束的时刻

Google宣布推出能够在后台执行任务的同时继续对话的模型。这种流畅性要求把从说话到行动的转换表达得更清楚。
当搜索或操作在别处执行时,对话仍可继续。这是Google为Gemini 3.8 Live及其Extended Thinking版本所强调的能力之一,二者于2026年9月15日发布。
并行地说与做
据Google介绍,这些模型可以在后台调用工具,同时保持交流不中断。Live版本还能近乎实时地处理视觉情境,并在九十七种受支持的语言之间切换。Extended Thinking则面向需要更复杂推理的任务。
这些能力均由提供方宣布。其在具体情境中的效果,应针对该情境加以评估,而不是从某次演示或某项排名中推断。
言语开始产生约束的时刻
在接待、培训或陪同访客时,一种不必每说一句就停下来查询工具的声音,可能显得更自然。然而,这种连贯性带来了一个设计上的难题:用户必须知道智能体是在解释、查找、准备,还是在执行一项操作。
在一家企业里,确认预约、修改信息和提出方案是不同的行为。语音界面应当清楚地说明这些行为,并在决定涉及客户或企业时安排相应的确认。
因此,有用的测试不仅限于语音质量,还涉及打断、歧义以及人工接手:如果用户在任务已经开始后改变主意,会发生什么?
如果流畅性能让责任保持可见,它就可以改善体验。服务必须保留一份易于理解的记录,说明提出了什么要求、授权了什么以及实际完成了什么。一次顺畅的对话本身并不足以证明操作正确。

Cette publication est également disponible en :
