上篇文章中我們介紹了什麼是口述影像,但口述影像只能用在看電影嗎?其實,還有更多應用場景等著我們去開發。
複習一下,口述影像最簡單的解釋是『把眼睛所見的換成文字用口語說出來」。
如果我們抓出幾個關鍵詞往下探究,會發現,口述影像的應用場景與模式可以非常多元。
眼睛所見的、換成文字、說出來,這三個關鍵詞代表了應用場景的類型變化。即使只是提供一部「給成年人」的「電影」的「國語版」口述影像,也可以有「即時說」或「事先錄製」等不同的口述影像呈現方法。另外,受眾最終「怎麼聽」,也會影響到口述影像的體驗,例如搭配口譯設備戴耳機聽、直接在現場聽或用 App 聽。
隨著影像內容的差異、口述者敘述條件的限制(如即時口說或事先錄製),實際使用口述影像服務的場景設計就會有所不同,甚至,還能挖掘出更多可能性。
接著,我們會介紹 6 個目前在台灣可以接近(近用)的應用場景,帶大家認識透過口述影像欣賞不同藝術作品的樣貌,彼此間又有什麼差異。
第一篇文章中以院線片為例,說明了在台灣欣賞口述影像版電影的流程,但其實,我們還能在不同地方聽電影(包含劇情片、紀錄片等),聆聽方式可以區分為共融場、專場、線上平台。括號後面標註的是常用的呈現方法,但並非絕對。
聆聽方式 A:共融場(事先錄製)
以一般院線片為例,為了不影響其他受眾的欣賞權益,想聽口述影像的受眾需要另外租借耳機設備,透過耳機額外接收口述影像的聲音。詳細的流程可以回顧第一篇的說明。
這類共融場的好處是,無論你傾向用視覺看電影或用聽覺聽電影,都可以在同一個場合欣賞電影,彼此間不干擾,並且,口述影像的聲音是透過耳機播放,會有一種他在你耳邊講給你聽的親切感。然而,由於資源有限,影廳跟廠商租借播放設備也需要一定成本,目前這類院線片通常限制必須憑身心障礙證件才能借用耳機設備,其他人無法體驗該服務。
聆聽方式 B:專場(即時口說)
如果是口述影像專場電影(如板橋府中 15 電影院辦理的場次),通常會安排一位口述影像講述員在場,他會坐在影廳內,用麥克風現場「即時口說」給受眾聽,他的聲音會從麥克風外接的喇叭音響播放出來。這類專場的優點是不用特別準備耳機設備給受眾,但對明眼人而言較無法依照自身習慣的方法看電影。
此外,也需要考慮現場麥克風跟影片聲音的干擾問題。例如,在 KTV 裡面一邊播放歌曲一邊用麥克風講話,可能導致兩種聲音都聽不清楚,或是因為所在位置與喇叭的距離,造成資訊接收程度的落差。
以下影片是中國盲文圖書館講解員-田珈寧做口述影像專場的採訪,影片中講解員坐在觀眾席後方,手持麥克風即時說明電影畫面,受眾不用帶耳機設備就能聆聽,影片時長 2 分 53 秒:
#中國盲文圖書館 --口述影像館 by 一条 Yitiao…
聆聽方式 C:線上平台(事先錄製)
如果是透過線上影音平台觀賞電影,通常會將口述影像的聲音跟電影本身的聲音直接合併在一起,播放影片時只要從單一來源聆聽,這邊我們先將此呈現模式稱為「綜合音軌模式」。由於不同影視作品可能會在左右聲道提供不同的內容(註1),口述影像的聲音有可能只在單一聲道輸出,也可能同時放在雙聲道輸出。
如果在 YouTube 搜尋「公視」「口述影像」,可以在 YouTube 頻道「公視點點愛」中聽到公視所提供的口述影像作品,就是採取綜合音軌模式呈現。
以下影片為 YouTube 頻道「公視點點愛」中,公視人生劇展口述影像版本電影播放次數最高的作品,《藥笑 24 小時》,片長 1 小時 28 分鐘,屬於綜合音軌模式。劇情中主要角色講台語,口述影像講國語:
@
付費的 Netflix、Disney+ 等平台也正積極建立口述影像資源,受眾可以自行選擇想聆聽的語言(如果該影片有配那麼多種的話)。假如要欣賞有提供口述影像的作品,需要在挑選影片聲音(如切換成國語配音、英文配音)的區塊選取「口述影像」,這時就會切換成口述影像的聲音。相較前面的共融場及專場會限制受眾的身分、限制受眾要在特定空間及時間內,綜合音軌模式可以幫助更多人更容易接近(近用)口述影像。
連續劇的片長雖然沒有電影那麼久,但是集數較多,總時長較長,提供口述影像的比例比電影更低一些。不過,它與非院線片的電影一樣,觀眾欣賞的是已經完成剪輯的影像作品,可以採用事先錄製的「綜合音軌模式」製作口述影像。
以下影片為 YouTube 頻道「公視點點愛」中,有提供口述影像版本的連續劇《麻醉風暴》的第一集,片長約 50 分鐘,屬於綜合音軌模式:
@
從影片中可以發現,連續劇由於集數多,通常出現的角色數量比電影更多,在口述影像的文稿撰寫上可能會特別突顯不同角色性格的差異。除了角色數量之外,演員講台詞跟口述影像使用的語言若不同時,也是一個製作上的挑戰。例如,鄉土劇演員講台語,口述影像要講國語還是台語?語言的選擇對文稿撰寫者及受眾具有不同的意義,詳細的製作挑戰會在未來的文章中繼續分享。
影視作品的另一大宗,是動畫 Animation(本篇文章中的動畫泛指 2D 或 3D 的卡通、動畫、動漫等 Cartoon、Anime、Animation 類型作品。例如《小豬佩奇》、《名偵探柯南》、《你的名字》、《冰雪奇緣》等)。除了在電影院播放的院線片動畫之外,一般來說,動畫的口述影像幾乎都是採用事先錄製的「綜合音軌模式」。
動畫與前述影視作品的口述影像,主要差異在於影片中聲音留白的時間及畫面虛擬性。
以學齡後為主要受眾的日本動漫為例,通常是由大量台詞、旁白組成,普遍情況下,比較不會出現如電影或紀錄片常使用的「遠景」、「長鏡頭」、「長時間不說台詞」的手法。因此,相對於電影,動畫幾乎不太有讓聲音留白的時間,同時,如同第一篇文章中提到,口述影像需要盡可能避免干擾受眾欣賞藝術作品,講述時,會儘量避開作品發出聲音(音樂、音效、人聲)的時間,最後,在動畫作品裡能留給口述影像的時間便十分有限。
如果遇到《虛構推理》(きょこうすいり)這種超大量台詞的動漫作品,口述影像可能真的配不了幾句吧(笑)
另外,動畫不同於攝影機拍出來的電影或連續劇,可以透過繪畫創造一個完全虛擬、非人型態的世界,如何描述不屬於真實世界的場景,是相當有趣的挑戰。例如,要如何描述《怪獸電力公司》(Monsters, Inc.)的毛怪跟三眼怪,或描述《腦筋急轉彎》(Inside Out)裡面變化多端的場景。
以下影片是 YouTube 頻道「公視點點愛」中的《水果冰淇淋》節目,每一集都會播放不同的動畫,這一集播的是《麋鹿不迷路》。片長 13 分鐘,屬於綜合音軌模式。
@
節目類型的影視作品,包含綜藝節目(如益智節目、脫口秀、音樂節目、選秀節目、生活體驗、實境節目、旅遊介紹)或比較具有新聞性的節目(如人物採訪、新聞報導、政論節目等)。不過,有提供口述影像的節目,數量比前述3個應用場景更少。
綜藝或新聞節目的口述影像,除了跟動畫一樣缺乏聲音留白的時間(如歌唱節目都在唱歌或講評,新聞節目有大量的對話跟旁白),另外,人物數量與動作及場景單一性也會影響可以講述的內容。例如,益智節目通常參與來賓非常多、人物採訪型節目的場景大多待在室內攝影棚錄製,較無場景變化需要描述。如果像韓國《大逃脫》(대탈출)這類以密室逃脫為主題的實境節目,能夠製作出口述影像版本的話,就有更多受眾可以用耳朵體驗解謎的快樂。
以下影片為 YouTube 頻道「公視點點愛」中,有提供口述影像版本的旅遊行腳節目《浩客慢遊》中名稱為「大樹、玉井。盛夏滋味」的集數,片長約50分鐘,屬於綜合音軌模式:
@
劇場演出常見的類型包括了舞台劇、舞蹈演出、音樂會。其特色在於,作品只有在劇場演出的當下才會「存在」,即使可以透過錄影將作品記錄下來反覆播放,但對於多數表演工作者及觀眾而言,錄製後的作品影像屬於「紀錄」,並非即時的「劇場演出」。
因為即興發揮、觀眾互動帶來的有機性,劇場演出通常是以即時口說的方式提供口述影像(目前多為共融場),講述者會坐在觀眾席或控台區,用麥克風即時說明場內畫面,受眾則用耳機設備聆聽口述影像內容。
在台灣,礙於人力,有提供口述影像的劇場演出十分稀少。以國家戲劇院為例,每年幾百檔的演出可能只有 10 檔具備口述影像版本。
不過,職業舞團「黃翊工作室」是例外。他們自 2018 年起開始嘗試提供口述影像版本的舞蹈演出,更承諾願意在未來的每個作品中都提供口述影像,也嘗試讓非視覺障礙的受眾體驗口述影像。
以下影片是「黃翊工作室」於 2018 年拍攝的紀錄影片,內容記錄了團隊嘗試打造口述影像的歷程,包含邀請視障學生參與前期口述影像文稿撰寫,邀請視障者參與舞台彩排與演出,聆聽受眾提供真實回饋,以及團隊舉辦的演後座談。影片中 20 秒到 1 分 07 秒,以及 4 分 0 秒到 5 分 03 秒的片段,可以聽到口述影像應用在劇場演出的示範。
vimeo 的影片:「黃翊工作室」於 2018 年拍攝的紀錄影片,內容記錄了團隊嘗試打造口述影像的歷程
逛展覽的時候通常會被服務台詢問是否需要租借「語音導覽」,那語音導覽跟口述影像版本的展覽又有什麼不同呢?主要差別在於考量「定位點」、「敘述的內容」、「其他輔助服務」。
一般逛展覽聽導覽的方法有兩種,專人導覽(由導覽員即時口說)、自行聽導覽(可能是租借耳機設備或透過 app,都需要戴上耳機,移動到作品前再依照作品旁邊標示的編號去選擇導覽音檔)。
然而,口述影像的導覽需要先考慮到使用者可能無法「自行抵達作品前」、「看到作品旁邊標示的編號」。因此,通常會特別設計展館動線,搭配定位點的設計,透過導覽儀器或手機的 GPS 找到受眾此刻靠近哪個作品,再播放對應的音檔。
同時,導覽的講述內容也需要考慮到受眾需求,不會只介紹作者或作品背景,還需要描述作品的特徵、顏色、質感、尺寸、細節等資訊。
以下影片是台中的國立美術館提供的口述影像音檔,內容為藝術家洪瑞麟在 1960 年創作的繪畫作品,名稱為《礦工頌》,影片時長 2 分 14 秒。
@
此外,由於雕塑類的作品很難只靠口語描述就讓人知道他的樣態,有些展館開始提供觸覺的設計物。例如用小模型、不同材質的物件去表達整個展場空間的設計;或是使用 3D 列印的方式做出複製品讓人可以直接觸摸作品的凹凸及質感;此外,國外更有單位嘗試用電阻讓人憑空觸摸到雕像。
以下影片是台中的國立美術館錄提供口述影像音檔,內容為藝術家黃土水於 1930 年創作的雕塑作品,名稱為《水牛群像》,影片時長分秒。
@
以下影片為布拉格國立美術館結合當地的視障協會 Leontinka foundation、捷克文化部門、 AI 軟體公司 NeuroDigital 等單位共同發起名為「Touching Masterpiece」(觸摸經典)的專案。影片中視障者戴上特製手套,雙手抬起放在身體前方上下移動,依照 3D 模型的軌跡,手套會在佩戴者移動到不同地方時產生震動,沿著震動處的軌跡就能在空中形成一個形狀的範圍,體驗者可以感受到雕塑上的鼻子或臉孔,就像是觸摸到一個真實的雕塑一樣。片長 2 分 15 秒。
@
目前台北故宮博物院、台中國立美術館、台南臺灣文學館有提供口述影像的導覽。不過,有些展覽場地與陳設,會隨著時間做調整或更換,事先錄製好的口述影像內容是否能即時反應變化,以及服務人員是否具備足夠的教育訓練,也是值得繼續努力的地方。
當不同領域的專家們認識口述影像的應用場景,便有機會思考自身提供的服務「是否無意間限制了某些人?」。當我們意識到這個問題,才能進一步調整或新增現有服務流程,並且增加更多不同的口述影像打開方式。
電影院的採購者可以考慮多引進口述影像版本的電影作品,拍戲的導演可以嘗試結合口述影像調整自己的創作角度,策展人可以試著設計出一個適合所有人參加的展覽,導覽員可以練習講一個閉上眼也能聽得懂的導覽,介面設計師可以運用口述影像技巧,在視覺元素上添加適當的替代文字。無論你的專業是什麼,都可以在所提供的服務中引進口述影像。
口述影像固然是一種幫助視覺需求者接近不同藝術作品的工具,更重要的是,我們如何集眾人之力打造一個視覺友善的環境,讓環境限制不再侷限彼此。
註1:所謂的左右聲道提供不同內容,是影視作品運用左右耳聽覺特性常見的製作手法。例如進電影院常聽到的杜比環繞音效廣告片,會感覺聲音來自四面八方環繞自己。左聲道的聲音如果只在左側喇叭輸出,聽者很大比例使用左耳接收聲音,會覺得影片中的聲音來自左方,可能畫面左方將有什麼事情發生,反之亦然。因此,當一段聲音分別透過左聲道及右聲道輸出時,可以創造出聲音來自不同方位的效果。
下集預告:口述影像製作經驗談
NOTE
如何在 Netflix 跟 Disney+ 上面找到口述影像版本的節目?
想在 Netflix 上找到口述影像版的作品,方法有3種:
- 方法 1:在搜尋列搜尋「口述影像」,會跳出有提供口述影像的作品,但數量較少。
- 方法 2:跳到首頁最下方功能列,點選「口述影像」專區,會跳出所在國家主要語言的口述影像作品。例如在台灣,會跳到「國語口述影像」專區。
- 方法3:在搜尋列搜尋「audio description in …」在 in 的後面輸入你想尋找的語言,例如「audio description in english」就有機會找到講英文的口述影像作品。除了英文,還有日文、韓文、西班牙文等不同語言的口述影像可以聆聽。不過,這個方法有可能只是找到該語言的配音,而不完全是該語言的口述影像。
以下圖片是 Netflix 首頁下方功能列的截圖,口述影像的區塊在社群平台連結區下方,功能列的左上角:

目前 Disney+ 並沒有像 Netflix 一樣提供查詢功能,直接搜尋「口述影像」或「Audio Description」沒辦法跳出相關作品。但是 Disney+ 上面其實有提供其他語言的口述影像,我們可以透過另一個網站來查詢。
在美國,有一個名為 ADP (Audio Description Project) 的組織,整理了各大影音串流平台上有口述影像的作品連結,如 Netflix、Disney+、Hulu 等。ADP 是全英文的網站,主要列出講英文的口述影像,網站裡面有個分類是「Non-English AD」,點下去可以找到不講英文的口述影像,目前中文大約有20幾個作品,主要集中在 Netflix 上面。
不過,由於線上串流平台會有不同地區買不同作品的版權問題,因此,不是每一個網站上列出的作品都可以在台灣的 Netflix 看到。
ADP 的網站連結:https://adp.acb.org/index.html
在本次收集資料的過程,意外發現有一個美國的 YouTube 頻道「SoundwaveSpectre」專門製作遊戲的口述影像。想不到吧?口述影像竟然還可以拿來追遊戲實況!!!
以下影片是該頻道錄製的《上古卷軸V:無界天際》(The Elder Scrolls V: Skyrim)的遊戲內容,可以聽到口述者描述遊戲中的場景切換,該遊戲偏向於電影劇情式的遊玩方法,講述者採取了事前錄製的方式呈現。點開前請留意該遊戲有暴力血腥元素。時長約1個小時。
@
相比一般遊戲實況主或專門錄製遊戲體驗的頻道,口述者花了比較多心力在描述操作選項,透過他的講解,受眾好像也正在操作遊戲畫面,可以跟著他「一起玩遊戲」。
以下影片是該頻道開直播玩《動森》的實況畫面,除了有實況常聽到的碎念、對遊戲內容的吐槽,也有對遊戲畫面、可愛物件及難以理解的動森語的轉述,相當有趣。時長約58分鐘。
該頻道主跟妻子都非常喜歡玩遊戲,兩人一起經營頻道,他的初衷是讓所有人都可以不受限制,一起享受遊戲的樂趣。
有一位網友留言說:「我非常感謝你錄製了這個內容,我很想玩這款遊戲,但我玩不了,因為我看不見。」
擴張應用場景,我們就可以挪去更多的障礙。希望在不久的將來,這位網友不用上來說他聽得很開心,而是上來分享他親自玩遊戲的心得。






