Блоки · AI

AI · Розпізнати голос

Перетворює голосове або аудіо на текст через GPT-4o Transcribe чи Whisper і кладе його у voice_text та last_message для наступних блоків.

Призначення

Блок бере аудіофайл і повертає розшифровку. Розпізнаний текст додатково записується в `last_message`, тому наступні блоки (Умова, AI відповідь) працюють із голосовим так само, як зі звичайним текстом.

Джерело аудіо

  • Останнє голосове / аудіо з будь-якого каналу — `channel_last` (last_tg_*, last_vb_*, last_meta_*)
  • Шлях до файлу зі змінної
  • URL аудіо зі змінної
  • Якщо аудіо немає — гілка «Помилка» з підказкою поставити перед блоком «Запит вводу» (voice/audio)

Налаштування

  • Модель: gpt-4o-mini-transcribe (рекомендовано), gpt-4o-transcribe або whisper-1
  • Режим: розпізнати мову або перекласти англійською
  • Мова аудіо (опційно) — підвищує точність у режимі розпізнавання
  • Переклад працює **лише** з моделлю whisper-1

Змінні після блоку

  • voice_text (або власна змінна) — розпізнаний текст
  • last_message — той самий текст
  • {змінна}_error — причина на гілці «Помилка»
AI · Розпізнати голос — Wiki Epsenta