115-1 聲音未來 · W12
聲音未來:科技與音樂文化 · Sonic Futures

W12

聲音與身體分離的當代史

2026.11.25 · 週三 2-4 節 09:00–12:00 · 南大電腦教室
吳秉聖

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

播放指示:不公布曲名/作者

播放約 90 秒。安靜聽完,不要先討論。
翻頁之前,先問自己:這個聲音是誰在唱?

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

你剛剛聽到什麼?

你剛才聽到的是 Cher, Believe (1998) 開頭約 90 秒。製作人 Mark Taylor 把當時剛上市的 Antares Auto-Tune 音準修正效果器,調到最極端的設定,讓修正的痕跡不是被藏起來,而是被大聲展示出來:那個顫音一樣的機械音高跳動,就是後來被稱為「T-Pain 效果」的源頭。

  • 這是「人在唱歌」,還是「機器在替一個人唱歌」?
  • Auto-Tune 原本的工作是把走音修「準」,這裡卻反過來拿修正的痕跡去炫耀:這個反轉說明了什麼?
  • 如果沒人告訴你這是 1998 年的錄音,你聽得出那個聲音效果距今快三十年嗎?

你今天聽到的每一個修過音的人聲,往上追,都追得到這 90 秒。

音源:youtube.com/watch?v=nZXRV4MezEw(Cher 官方頻道)| 離線:decks/audio/w12-cher-believe.m4a

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

核心問題

聲音可以脫離身體存在嗎?

那「人聲」還是人嗎?

留聲機把聲音第一次搬出身體之後,
每一次新技術,都在重新回答這個問題。

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

框架①:七段時間線

年代 事件 這一步剝離了什麼
1877 / 1920s 留聲機(Edison)、廣播 聲音第一次不需要說話者在場
1900s– 錄音工業 歌手的「聲」變成可買賣的智慧財產
1920s–1980s 電子合成:Theremin → Moog → DAW 聲音不再需要任何身體發聲
1997 / 1998 Auto-Tune → Cher Believe 音準本身被標準化成一條可調的數值
2004 / 2007 Vocaloid → 初音未來 完全合成的虛擬人聲,偶像不需要肉身
2010s– AI 聲音複製與 deepfake 聲音表演不再需要當事人同意
2023 / 2024–25 SAG-AFTRA 兩次罷工 聲音第一次在勞動合約裡被明文定價

參 Sterne《The Audible Past》;Rambarran《Virtual Music》;Oyola, "In Defense of Auto-Tune"(Sound Studies Blog, 2011);Stanyek & Piekut, "Deadness"(TDR, 2010)

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

框架②:無源術語表

三個詞,直接進入今天的討論:

  • acousmatic(無源):只聞其聲、不見其源。Schaeffer 借用畢達哥拉斯門徒隔簾聽課的傳說命名
  • acousmêtre(無源人物):Michel Chion 命名的電影角色類型,聲音能被聽見、身體卻定位不到;因此擁有「無所不在、無所不見、無所不知、無所不能」四種力量
  • disacousmatization(去無源化):掀開布幕、把聲音重新扣回一個身體的動作;Dolar 主張人聲從不真正完成這個動作

三個詞今天會反覆出現:Cher 的聲音、初音未來的聲音、AI 複製的聲音,都活在「無源」和「去無源化」之間那道沒有真正被彌合的縫隙裡。

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

框架③:種族在耳朵,不在喉嚨

Nina Sun Eidsheim,《The Race of Sound》

Eidsheim 把「這是誰的聲音」這個無源提問,從聲音本身的屬性,翻轉成聽者的行動:問「這是誰」不是因為無源人聲終究會給出答案,而是因為它結構上永遠給不出答案。聽者聽到的「種族」,是聽者自己投射上去、再拿聲音回頭驗證的一個循環。

  • Vocaloid 的 LOLA/LEON 被工程團隊設計成「黑人靈魂歌手」,包裝甚至用了黑臉圖像;使用者實際聽到的卻是「帶日本腔、講話像西班牙人的英國靈魂歌手」
  • #SaveRuby 事件裡,粉絲反過來要求合成聲音的虛擬形象,必須對應配音員本人的拉丁裔身分:同一套本質論反射,換了一種數位形式

種族沒有被藏進聲帶,是被聽者的耳朵訓練出來的。

(論點速寫,非逐字引用)

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

精讀①:無源人聲的縫隙

Brian Kane, Sound Unseen: Acousmatic Sound in Theory and Practice (2014), Ch.5 "Kafka and the Ontology of Acousmatic Sound"

"According to Mladen Dolar, the acousmatic voice “always displays something of an effect emancipated from its cause. There is a gap between the source and its auditory result, which can never be quite bridged.” In fact, Dolar goes so far as to argue that the acousmatic voice can never truly be effectively latched back onto a body, that “there is no such thing as disacousmatization.” No matter how drastic one's curiosity or how fervently one tears down the veil to see the speaker behind the curtain, there is no de-veiling of the voice."

PSW 譯:「根據 Mladen Dolar 的說法,無源人聲『總是顯示出一種與其成因脫鉤的效果。聲源與其聽覺結果之間存在一道裂隙,這道裂隙永遠無法真正被彌合。』事實上,Dolar 更進一步主張,無源人聲永遠無法真正重新扣回一個身體,因為『根本不存在所謂的去無源化這回事。』無論好奇心多麼強烈,無論多麼用力掀開布幕去看清簾幕後方的說話者,人聲都不會因此被揭去它的布幕。」(pp.149–150)

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

精讀②:無源黑人性(原文)

Nina Sun Eidsheim, The Race of Sound: Listening, Timbre, and Vocality in African American Music (2019), Introduction

"In other words, we can begin with a set of statistics about the human body, but a number of forces combine to bring out one set of this body's potentialities while dampening others — and it is with this culture- and value-driven process that The Race of Sound is concerned. I aim to indirectly, but nonetheless intentionally, address the ways in which sociophysical conditioning (rather than skin color or some other measurement) structures the naming of race. I wish to enumerate some of the many ways in which the advantage of accumulated privilege is preserved, not only across historical time and geographic space but also in sounds, to create the recognition of nonwhite vocal timbre. Thus I build on Obadike's keen observation that hip-hop music may summon the presence of blackness without an accompanying black body. Extending this concept to the case of African American singers, I suggest that her term and concept acousmatic blackness may also capture the perceived presence of the black body in a vocal timbre, whether or not that body is determined to be black by other metrics. The acousmatic question is the audile technique, or the measuring tape, used to determine the degree to which blackness is present. And because of the acousmatic question's inability to yield a precise answer, any identification of black vocal timbre is, by definition, blackness formed in response to the acousmatic question."

CC BY-NC-ND 3.0 US(Duke University Press 開放取用版)

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

精讀②:無源黑人性(譯文)

PSW 譯:「換句話說,我們可以從一組關於人體的統計數字出發,但有一連串力量共同作用,讓這具身體的某些潛能被彰顯、另一些則被壓抑:《聲音的種族》關心的正是這個由文化與價值驅動的過程。我打算間接卻明確地處理:社會身體性的制約(而非膚色或其他測量方式)如何建構了種族的命名。我想列舉出,累積特權的優勢不只跨越歷史時間與地理空間被保存下來,也在聲音裡被保存,進而製造出對非白人聲音音色的辨識。因此我承接 Obadike 敏銳的觀察:嘻哈音樂能召喚出黑人性的在場,卻不必伴隨一具黑人身體。把這個概念延伸到非裔美籍歌手身上,我認為她提出的『無源黑人性』一詞與概念,同樣能捕捉到黑人身體在聲音音色中被感知到的在場,無論這具身體是否經由其他指標被判定為黑人。無源提問,正是那把用來測量黑人性存在程度的聽覺技術,也就是那把量尺。而正因為無源提問無法產生精確的答案,任何對黑人聲音音色的辨識,依定義而言,都只是回應無源提問所形成的黑人性。」(p.6)

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

判準:科技奇觀 vs 指認責任

科技奇觀獵奇 文獻回答不了的判斷
「AI 複製聲音好厲害/好可怕」的驚嘆句 誰的聲音被拿去訓練模型?當事人同意了嗎?合約裡寫了什麼?
條列 Auto-Tune/Vocaloid/AI 聲音技術的「進化史」 每一次技術升級,把誰的勞動、誰的著作權,往哪個方向重新分配?

好報告不是把技術史背一遍,是指出誰的聲音被拿走、誰簽了什麼字。

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

交棒:五軸的下一題

認養該軸的組,下週帶著這題開場。

  1. 聲音、身體與聆聽經驗:Szendy 從 1835 年版權法讀出「聽眾」被發明的那一刻,你今天訂閱串流服務時,簽下的是哪一種聽眾身分?
  2. 科技與造音:Playlist 本身就是一種造音科技,策展演算法怎麼替你決定「接下來要聽什麼」?
  3. 標準化與協議:推薦演算法把「品味」量化成一組可排序的數字,這套標準化,篩掉了誰的品味?
  4. 權力、法律與平台:Spotify 的分潤模型怎麼分錢?這套經濟結構,替誰的收入兜底,又讓誰墊底?
  5. 在地現場與另類實踐:StreetVoice 之類的台灣獨立音樂平台,是真的替代方案,還是換一個地主收租?
吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

本週作業

  1. 各組完成 W12 子題 summary(W13 課前繳)
  2. 期中個人書評 progress check:W13 課前回報書單與進度
  3. 下週指定閱讀:Szendy 節錄(延續 W1 精讀);老師另提供 Fisher/Noble/Zuboff 速寫材料
吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

下週預習

W13 · 串流平台+演算法政治

12/2 上課
Szendy,Listen: A History of Our Ears 節錄
Data 平台經濟結構補充材料(老師課前公告)

吳秉聖 · 國立清華大學藝術學院學士班
115-1 聲音未來 · W12

Q & A

課程資料:edu.pingshengwu.com(學期初公告)

吳秉聖 · 國立清華大學藝術學院學士班