Голос входит в микрофон, а до усилителя по плате бегут только BCLK, LRCLK и последовательность I²S. Voicebox FX на RP2350 показывает удобный маршрут цифрового звука и одновременно уточняет смысл слова «effects»: прошивка сперва складывает до 20 секунд речи в RAM, сохраняет WAV, затем запускает обработку и воспроизведение. →
Полнодуплексный I2S на STM32F407 разносит обслуживание RX и TX DMA на половину кольцевого буфера: передача стартует первой, а приём запускается из half-transfer обработчика. На стенде с WM8731 схема отработала стереопоток 48 кГц, 16 бит; GPIO-осциллограмма подтвердила чередование обработчиков и окно для DSP между событиями DMA. Целостность семплов отдельно не проверялась, а лог содержит LongSaveErrorCnt: 1 и SlowReadError: 2. →
RP2350 с 520 KiB SRAM запускает VAD, распознавание 50 голосовых токенов и синтез речи, резервируя около 468 KiB памяти. Moonshine Micro экономит SRAM за счёт общей TFLM-арены: VAD, классификатор и TTS выполняются последовательно, поэтому запись приостанавливается на время классификации и ответа. Полный цикл занимает 0,7–1,0 с, а архитектура рассчитана на команды и изолированные слова, а не на диктовку. →
Аудиопроцессор обычно ассоциируется с отдельной DSP-микросхемой, ЦАП и сложной платой вокруг неё. Прошивка DSPi заставляет Pico-class контроллер принимать цифровой звук по USB или S/PDIF, фильтровать и задерживать полосы, а затем раздавать их нескольким цифровым аудиовыходам. В Pico 2 для этого задействован аппаратный float, а у старого RP2040 та же работа идёт в Q28 fixed-point. →