待验证50% 置信事实精确时间
苹果的Siri与键盘联动、谷歌的Gboard语音转文字、GPT-4o的语音加视觉复合输入都是多模态方向的具体实践
1
来源数
50%
置信度
中期 (~90 天)
时效性
2026/9/27
首次发现
有效期至:2026/12/26
来源
涉及实体
相关事实
待验证语音助手响应质量差异大:Apple Watch的Siri、华为小艺可实现较流畅的语音发消息/设闹钟,但离线状态下大部分复杂交互失效,看中语音交互需确认是否依赖网络73% 相似待验证Apple 提供 Speech Framework 支持设备端语音识别,但能力主要限于转录,缺乏LLM润色环节72% 相似待验证传统ASR系统如Google Speech-to-Text或Apple Dictation的核心任务是将音频信号映射为词序列的声学建模71% 相似待验证语音助手可用性差异大:Apple Watch的Siri和华为小艺可离线执行本地指令(设闹钟、开运动),部分廉价表语音需连手机才响应且识别率低,看重语音交互应选大厂旗舰71% 相似待验证语音交互能力差异大:Apple Watch的Siri和三星Bixby可脱离手机联网执行操作,多数国产运动表语音仅支持本地简单指令,无法完整语音助手体验70% 相似
引用此条事实
Stable URI
https://kongchang.com/claim/953446API
curl https://kongchang.com/api/v1/knowledge/claims/953446MCP
get_claim(id=953446)