联系我们
 课程时长 14 小时

课程大纲

音频与噪声基础

  • 关键概念:波形、频率、振幅和动态范围
  • 噪声类型:环境噪声、设备噪声、数字伪影
  • 传统与AI驱动的降噪方法对比

AI音频增强工具概述

  • AI模型如何处理和清洁音频
  • 工具对比:Krisp、Adobe Enhance、RNNoise、NVIDIA RTX Voice
  • 部署选项:本地、云端和实时集成

使用Krisp进行实时会议

  • 在Windows/macOS上安装和设置
  • 与Zoom、Teams和Skype集成
  • 实时音频测试和常见问题排查

使用Adobe Enhance增强录音

  • 上传并清洁播客类录音
  • 局限性、延迟和质量控制
  • 与Adobe Audition或Premiere结合使用

在自定义管道中部署RNNoise

  • RNNoise开源库概述
  • 使用FFmpeg编译和使用RNNoise
  • 在监控或VoIP系统中的自定义集成

评估质量与性能

  • 指标:信噪比、延迟、CPU/GPU影响
  • 跨用例测试:会议、录音、现场音频
  • 人类感知与客观评分工具

案例研究与工作流程集成

  • 法律和金融行业的企业会议设置
  • 媒体制作管道中的降噪
  • 用于证据和监控审查的音频清洁

总结与后续步骤

要求

  • 了解基本的数字音频概念
  • 熟悉使用音频编辑或沟通工具

目标学员

  • 音频工程师
  • IT支持团队
  • 媒体制作部门

即将举行的公开课程

课程分类