单元三 · 图像声音与视频的智能生成

第14课 声音的智能生成

任务场景
任务场景:声音的智能生成

一、学习目标

  • 认识声音生成的主要方法,包括合成波形生成声音、拼接字词生成语音、用大模型生成音乐等。
  • 知道人工智能生成声音可能带来的伦理、安全与著作权等方面的潜在问题。

二、情境导入

当前,随着人工智能技术的快速发展,出现了许多能够智能处理声音的创新应用。

例如:语音识别技术已广泛应用于智能助手、实时字幕生成和语音转写服务;

音乐生成系统能基于人工智能自动创作旋律、编曲甚至模仿不同风格的音乐。

三、核心讲解

本课学习路径:

1声音生成的主要方法
2声音生成的伦理与法规

1.声音生成的主要方法

生成声音是指通过技术手段模拟或合成新的音频信号,使机器能够“创造”出人类语音、音乐或其他类型的声音。

声音生成的主:先抓住「声音生成的主要方法」在做什么,再用例子对照验证。
  • 方法一:打开Mixly AI学习平台中的《声音波形模拟》模块,利用数学函数组
  • 合模拟声音波形,最终生成声音。尝试不
  • 同组合,感受所生成声音的特点。
  • 手动调整产生的声音会相对单调,但
  • 借助人工智能手段,根据需要自动调整波

想一想:制的声音有哪些差别?

弄清以上要点后,再进入下方动手体验,用实际操作验证。

四、动手体验 · MixAI 组件

请在下列组件中完成操作,至少体验一个并记录现象。

组件 model_sound_waveform — 在框内完成操作

五、课堂总结

  • 可以利用数学函数组合模拟声音波形,实现声音生成。
  • 可以将单个字(词)的读音进行拼接组合,进而合成相应的语音。
  • 可以借助人工智能技术,根据文本生成高质量、富有表现力的声音。
  • 声音生成技术在带来便利的同时,也可能引发伦理与法律问题。

六、拓展提升

拓展:假如你是校园广播站的成员,正在筹备“每日经典诵读”栏目,计划每天清晨播放经典诗词朗读,让同学们在诗意中开启一天的学习生活。但在准备过程中发现,由人来录音既费时又费力。

测评

完成练习后作答;选出后点「检查」。答错会显示简短说明。

  1. 下列哪一项更接近本课学习目标?

  2. 本课课堂总结强调的是?

  3. 本课主题最贴近下列哪一项?

  4. 完成本课后,优先应该做什么来证明学会了?

  5. 判断:教学指南中的学习活动可以全部跳过。

  6. 拓展提升部分的作用是?

本节小结

回顾本课要点,完成动手体验与测评。记住:声音的智能生成。