Unverified50% confidenceFactExact time
Gemma E2B 变体具备原生音频理解能力,可直接处理音频频谱特征而无需独立的语音识别模块
1
Sources
50%
Confidence
Long-term
Relevance
7/11/2026
First Seen
Sources
WisprGemma:纯浏览器本地语音输入,数据不上云
redditr/GoogleGeminiAI7/10/2026
Related Claims
UnverifiedGemma 4的1B/2B模型自带语音识别功能79% similarUnverifiedGemma 4 新增了音频对话能力,支持 wav、mp3、m4a、flac、webm 等音频格式,并加入「保留思维链」功能67% similarUnverified自回归神经语音模型的代表包括微软的VALL-E和VALL-E 265% similarUnverified支持EQ调节App的机型可后期调整低音/高音补偿声场缺陷,无App纯物理调音的机型声音风格固定,对听音偏好挑剔者建议选带App调音功能的品牌65% similarUnverified声纹识别的技术基础是声道形态、基频特征等被认为具有个体唯一性的声学参数,但语音克隆能绕过基于MFCC或深度嵌入向量的自动声纹核验系统64% similar
Cite This Claim
Stable URI
https://kongchang.com/claim/488222API
curl https://kongchang.com/api/v1/knowledge/claims/488222MCP
get_claim(id=488222)