单元二

第10课 语音识别:把声音变成文字

任务场景:语音识别——把声音变成文字
任务场景:语音识别——把声音变成文字

一、听懂你在说什么

原理图:声音变成文字(语音识别)
原理图:声音变成文字(语音识别)

语音识别(英文常写 ASR,即 Automatic Speech Recognition)把麦克风里的声音变成电脑能处理的文字。音箱、输入法、字幕都靠它。本课用本地关键词模拟:你输入含「打开台灯」等词的句子,就当作「听写」成功。

想一想:嘈杂环境、口音不同、说话太快——真实识别也可能听错,所以重要指令要再确认。

网页体验:语音识别

文字点「识别」,或点「麦克风识别」说出:打开台灯 / 播放音乐 / 明天天气

二、知识点讲解

语音识别把麦克风收到的声音变成可判断的命令或文本。它通常只能稳妥识别训练好的口令表,不是随意聊天;本课重点看「听对了没有 → 有没有播报/执行」,也就是有没有形成闭环。

先弄清本课输入与输出,再进编程练习对照现象。

三、课堂练习

先完成两道正误判断,再做其余题目;选出后点「检查」。

  1. 判断:只点体验按钮,说不清「AI 做了什么、人做了什么」。

  2. 判断:每完成一次体验,用一句话说清本课要点「语音识别」,并区分生成结果与你的判断。

  3. 语音识别主要做什么?

  4. 本课体验如何「听」你说话?

  5. 识别出错时,更合理的做法是?

四、本节小结

听懂了,还要会「说」——