語音控制提詞器怎麼運作:VoiceScroll 原理解析
一般提詞器會照著你設定的速度一路往上捲。你一停頓,腳本就先跑掉;你想留個空白,反而得等畫面追上你。VoiceScroll換了做法,它不是要你追著文字走,而是讓文字跟著你的說話節奏移動。
為什麼固定速度總是不好用
真實說話本來就不會等速。熟悉的地方會快一點,重點會慢一點,中間也會停頓、重講、換個說法。固定速度把這些變化全忽略掉,最後就變成你在配合機器,而不是自然地說話。
VoiceScroll怎麼跟上你的聲音
- 匯入腳本後,App 會先整理文字,方便後續定位。
- 按下開始後,麥克風啟動,語音辨識開始處理你的聲音:iPhone 和 iPad 上使用 Apple 的語音辨識,Android 上使用裝置上安裝的辨識服務(通常是 Google)。
- 辨識出的內容會和腳本比對,找出你目前講到的位置。
- 已經說過的段落會淡掉,當前位置維持在可見範圍內,畫面自動跟著捲動。
全部在裝置本機完成
預設情況下,辨識在裝置本機完成(iPhone、iPad 使用 Apple 的 Speech 框架,Android 使用裝置內建的辨識服務,且需要已安裝該語言的離線語言包)。在這個預設狀態下,音訊不會送到伺服器,語言準備好之後也不需要連網。沒有網路往返延遲,也不怕現場訊號不穩。線上辨識是需要你自己開啟的選項,預設關閉(iPhone、iPad 從 2.0.4 起使用 Apple 伺服器,Android 從 1.11.16 起使用 Google),開啟後音訊會傳送到該服務。它在 iPhone、iPad 上支援 34 種語言、在 Android 上支援 26 種語言,包括中文和日文,多語腳本也能用同一套方式操作。
最適合的情境
- 錄影時常會停下來、重講或臨時改句子
- 演講過程會被掌聲或提問打斷
- 中文、日文這類不適合固定捲動速度的腳本
- 長篇錄製,希望始終照自己的節奏說