品牌行銷

品牌聲音辨識:讓消費者光聽聲音就認出你,中小企業也能低成本做

出門前要挑衣服的顏色、印名片要選字型,這些「看得到」的品牌決定,大概每個做行銷或做品牌的人都想過。但很少人認真想過另一件事,如果自己的品牌會發出聲音,聽起來會是什麼樣子?

手機收到通知的那一聲提示音、廣告開頭那幾個音符、客服電話轉接時放的等待音樂,其實跟色彩、字體、Logo 一樣,都是消費者認得出品牌的線索。差別只在於,色彩與字體多半有人刻意設計過,聲音卻常常隨便交給預設鈴聲、隨手抓一段免費配樂,或乾脆什麼都沒有。品牌聲音辨識(sonic branding)說的就是把這件事當一回事,刻意設計一套聲音系統,長期、一致地用在品牌出現的每一個接觸點上,讓消費者光聽聲音就認得出是誰。

這不是什麼新概念,只是長期被行銷人晾在色彩與字體後面。先從它跟廣告配樂的差異講起,再一路拆到台灣的中小企業現在具體能怎麼動手。

品牌聲音辨識是什麼?從看得見的識別走向聽得見的識別

多數人聽到「品牌聲音」,第一個想到的是廣告配樂,或者某支廣告片尾那句琅琅上口的口號。但廣告配樂通常只服務一支廣告,檔期結束就換掉;品牌聲音辨識剛好相反,它追求的是一套聲音、用很多年。就像色彩系統一旦定案,不會每次做新素材就換一次主色,聲音也一樣要在 App 開啟音、廣告、實體店內、活動現場、客服語音這些不同場合裡反覆出現,消費者才有機會把這段聲音跟品牌畫上等號。

這套系統裡還有一層更小的單位,叫做「聲音商標」(sonic logo)。它通常只有短短三到四秒,是整套聲音識別裡最精煉、最常被單獨拿出來播放的那一小段,功能類似視覺識別裡的 Logo 圖形。聲音商標是「點」,品牌聲音辨識是「面」,一套完整的聲音識別會包含聲音商標,也會包含品牌配樂的調性、客服語音的語氣,甚至產品操作介面的提示音風格,是一整套規則,不是單一個音效檔。

品牌聲音辨識把同一套核心聲音,一致地用在 App 開啟音、廣告、實體店內、活動現場、客服語音等接觸點上
品牌聲音辨識的做法:讓同一套核心聲音,長期一致地出現在每一個接觸點。

國際上已經有不少案例可以具體感受這個差別。Intel 那五個音符的提示音,早在 1994 年就由作曲家 Walter Werzowa 譜寫完成,幾十年來不管廣告怎麼換,這五個音符幾乎沒變過,是企業聲音識別裡歷史最久、也最常被引用的案例之一。Netflix 打開 App 時搭配紅色 N 字動畫出現的那聲提示音,是近十年才變得普及的新案例,說明這件事現在仍在發生,不是只有老品牌才做。麥當勞從 2003 年開始使用的五音符口哨旋律,搭配那句「i’m lovin’ it」,一路沿用到今天,正好示範了什麼叫長期一致,而不是單次配樂。

聲音可以被正式保護,也不是新鮮事。NBC 的三聲鐘聲最早在 1927 年由內部發想開發,原本只是給電台工程師與主播使用的播出提示音,幾年後才精簡定型成現在熟知的三個音符,後來又在 1950 年獲得美國專利商標局核准,成為美國第一件純聲音商標,距今已將近一百年。這說明聲音也能像視覺商標一樣被登記保護,並不是這幾年才冒出來的新趨勢,而是有相當長的歷史。

Mastercard 在 2019 年 2 月葛萊美獎週正式發表的聲音識別系統,則示範了系統跟單一音效的差別。他們找了多國音樂人與製作團隊,把同一段核心旋律改編成適合操作提示、電影式片頭、輕快廣告等不同場合的多個版本,讓消費者不管在哪個場合聽到,都能認出是同一套核心旋律的變形。這正是品牌聲音辨識的目標,不是做出一個音效,而是做出一套聽得出這是同一個品牌的系統。

Intel、Netflix、麥當勞、NBC、Mastercard 等國際品牌經營聲音識別的案例,年代橫跨 1929 到 2019 年
從 NBC 的三聲鐘聲到 Mastercard 的聲音系統,國際品牌經營聲音識別已有近百年歷史。

聲音對品牌記憶的效果比畫面更強

會花力氣做這套系統,不是因為好玩或跟風,而是聲音本身在記憶與情緒機制裡,本來就佔了一個特別的位置。牛津大學跨感官知覺研究學者 Charles Spence,在 2024 年於同行評審期刊《Psychology & Marketing》發表的一篇綜述論文裡,系統性彙整了聲音與品牌記憶、情緒連結之間既有的研究成果。這說明聲音會影響品牌記憶,不是行銷部門自己講講的話術,而是跨感官知覺學界長期在關注的研究領域;另一篇 2023 年刊登在《International Journal of Advertising》的論文,同樣把聲音品牌當成一個值得認真研究的主題來討論。

有了學理支撐,接下來的問題是,一致的聲音能帶來多少實際效果?音訊效果測量機構 Veritonic 與美國大型音訊媒體集團 Audacy,在 2023 年發布的一份聯合研究給出了具體數字。搭配一致聲音識別的品牌,消費者回想起來的難易度提升了 77%;放進廣播廣告裡,品牌回憶度提升 17%;放進 Podcast 廣告裡,則提升 14%。同一份研究也發現,具備聲音識別的品牌被認為多 7% 值得信賴、多 6% 討喜。這些數字都來自具名的市場研究機構,不是網路上流傳、查無出處的整理文。

搭配一致聲音識別的品牌,品牌回想難易度提升 77%,廣播與 Podcast 廣告回憶度分別提升 17% 與 14%
一致的聲音識別讓品牌回想難易度提升 77%,各項品牌指標也同步上升(資料來源:Veritonic 與 Audacy)。

聲音資產的效力,甚至可能超過人們一般認知的視覺元素。國際市場研究機構 Ipsos 在 2020 年一份分析各種獨特品牌資產效果的報告中發現,具識別性的聲音資產,在推動廣告效果與品牌聯想這件事上,效力比口號、Logo 這類常見的視覺元素高出超過 8 倍。換句話說,一段消費者聽過就記得的旋律,拉抬品牌被記住的機會,可能比一句口號或一個圖形標誌還要有效,這也是為什麼越來越多國際品牌,願意把預算從純視覺搬一部分到聲音上。

缺少畫面的品牌識別場域正在增加

過去做品牌識別,幾乎預設消費者一定看得到畫面,招牌、包裝、網站、廣告版位,都是有螢幕或有實體的場合。但消費者跟品牌互動的地方,正在往聽得到、看不到的方向擴散,只靠視覺這一套規則,開始在某些場合完全用不上。

語音助理與智慧音箱,聽不到品牌畫面的場域

智慧音箱、語音助理這類裝置,整段互動裡從頭到尾沒有畫面。消費者對著音箱問天氣、下訂單、聽新聞摘要,眼前沒有 Logo、沒有色彩、沒有字體可看,品牌唯一能被感知到的,只剩下語氣、提示音,以及有沒有專屬的回覆音效。

這不是少數人的行為。國際知名音訊產業研究機構 Edison Research,與美國國家公共廣播電台 NPR 合作發布的《The Smart Audio Report》2022 年版指出,美國有 35% 的成年人擁有智慧音箱,對照 2017 年僅 7% 的擁有率,成長幅度相當可觀;而在使用者裡,有 57% 每天都會用到某種語音指令,平均一個擁有智慧音箱的家庭,會擁有 2.6 台裝置。這是美國市場的調查數字,但它清楚說明了一件事,無畫面互動正快速變成日常場景,不是邊緣情境。當消費者已經習慣用耳朵而非眼睛認識品牌,只靠視覺識別的品牌,在這些場合裡幾乎等於隱形。

短影音把聲音本身變成內容

如果智慧音箱代表的是聽不到畫面,短影音代表的則是相反的力量,在這類平台的生態裡,聲音不是背景配樂,而是內容本身。使用者會為了一段特定的聲音去拍片、去模仿,聲音的傳播力有時候比畫面還強。

TikTok 官方公布的一手數據顯示,有 88% 的使用者認為聲音是 TikTok 體驗裡不可或缺的一環,平台明確把聲音定位成跟畫面同等重要的內容元素,而不是使用者關掉也無妨的配角。這對品牌的意義是,聲音已經從單純的識別工具,變成一種可能主動被傳播、被模仿的內容資產,如果一段品牌聲音夠有記憶點,它自己就可能變成流行的素材,而不只是被動等消費者去記住。

台灣商標法承認聲音可以註冊為品牌資產

把視角拉回台灣,經營聲音識別除了行銷效果,長期還可能形成一項可以受到法律保護的無形資產,而且這件事在台灣早就有法源依據,只是很多中小企業主根本不知道。

經濟部智慧財產局的資料明確載明,自民國 92 年(2003 年)11 月 28 日施行的商標法修正案起,聲音就可以合法申請註冊為商標。申請時必須用文字、簡譜或五線譜的方式,把這段聲音清楚表達出來,還要檢附載有該聲音的音檔才算完成申請。智慧財產局官方公布的申請範例,能讓這件事變得很具體,AT&T 的商標圖樣描述寫的是「口語說出字母 AT&T,同時搭配 C 調 Fa、降 Si、So 與 Do 為主旋律」;台灣本地的「新一點靈 B12」,商標圖樣描述則是「由音符 ㄇㄧ、ㄌㄚ、ㄙㄛ、ㄈㄚ、ㄇㄧ、ㄉㄨㄛ、ㄖㄨㄟ、ㄒㄧ、ㄉㄨㄛ 等旋律組合而成,歌詞為『新一點靈 B12』」。這兩個範例本身就是正式的申請書寫法示範,讓人具體看到聲音商標長什麼樣子,從抽象概念變成看得懂的文件。

換句話說,聲音商標在台灣不是理論上可行,而是已經有二十多年的實際申請歷史,連申請書該怎麼描述都有現成範例可以參考。這件事對中小企業主的意義是,認真經營一套品牌聲音,除了讓消費者記得住,長期也可能是一項能夠登記、能夠主張權利的無形資產。

AI 音樂生成工具,把作曲門檻降到中小企業也跨得過

過去要做出一段像樣的品牌旋律或提示音,得委託專業的作曲、編曲團隊,時間跟預算都不是多數中小企業負擔得起的規模。這也是為什麼過去談到聲音識別,大家直覺會想到那是國際大廠才玩得起的事,聽起來很好,但做起來門檻太高。

現在的生成式 AI 音樂與音效工具,把這道門檻降低了不少。輸入品牌調性的描述,像是「沉穩」、「俐落」、「活潑」,幾分鐘內就能拿到一段可用的旋律或音效草稿,不再需要一開始就找專業團隊、投入大筆預算才能有東西可聽。舉例來說,一家原本連品牌旋律都沒想過要做的中小企業,現在可以先用生成式 AI 音樂工具嘗試做出一段幾秒鐘的通知音效或開場旋律,拿去測試看看顧客有沒有印象、喜不喜歡,再決定要不要投入資源找專業團隊定案。

要注意的是,AI 生成出來的東西該被當成起點,而不是終點。它適合用來快速產出一版簡單的通知音效或短旋律去測試市場反應,但不宜期待它一次到位就產出一整套跨越所有接觸點都好用的完整識別系統,這件事仍然需要人的判斷去調整、去統一風格。這裡也要把界線劃清楚,這一段講的是器樂、環境音效、旋律這類聲音的生成,跟複製或模仿真人講話聲音的聲音克隆技術是完全不同的範疇,後者牽涉到詐騙與冒用的風險,跟中小企業想做一段品牌通知音效,是兩件完全不相干的事。

從一段通知音效開始,練習品牌的聲音個性

看到這裡,不代表得馬上砸預算做一整套完整的聲音識別系統。更務實的起點,是先想清楚你的品牌如果會發出聲音,聽起來該是什麼個性,是沉穩內斂,還是活潑俐落?這個問題的答案,其實跟原本在做的色彩與字體選擇邏輯是一樣的,只是換了一種感官去回答。

想清楚個性之後,不必一次做齊整套系統,從一個最小可行的聲音資產開始就好,App 的通知音、影片開場的兩三秒音效、客服電話等待時播放的音樂,都是很好的起點。這跟視覺識別當年的路徑其實一樣,多數品牌也是先有一個 Logo,才慢慢擴展成完整的識別系統,聲音沒有理由要跳過這個階段、直接一次做到位。

智慧財產局的申請須知裡有一項規定,恰好從側面說明了這個順序的道理,聲音商標如果原本不具識別性,申請人可以提出實際使用的證據,例如廣告影音、銷售資料,來證明這段聲音已經在交易上成為代表自己的標誌。換句話說,先把聲音實際用出來、看它有沒有真的被記住,本來就是這件事該走的順序,不是一步到位地砸錢做完就結束。而比音效本身複雜與否更關鍵的,是能不能長期、一致地用下去,這也呼應了最前面的定義,品牌聲音辨識比的不是誰的旋律更華麗,而是誰能把一段聲音,用得夠久、用得夠一致,久到消費者光聽見那幾個音符,就知道是誰在說話。

視覺識別花了幾十年才變成品牌經營的基本功,聲音現在正走在同一條路上,只是還沒有那麼多人動手。從一段通知音效開始練習,可能就是多數中小企業現在最務實的第一步。

資料來源
  1. Joint Study by Audacy and Veritonic Reveals How to Make the Most Effective Audio Ads (2023) — Veritonic 與 Audacy
  2. The Power of You: Why Distinctive Brand Assets Are a Driving Force of Creative Effectiveness (2020) — Ipsos
  3. Sonic branding: A narrative review at the intersection of art and science, Psychology & Marketing (2024) — Charles Spence
  4. Sonic branding as a promotional tool: a concept whose time has come and a call for research, International Journal of Advertising (2023) — International Journal of Advertising
  5. The Smart Audio Report 2022 — Edison Research 與 NPR
  6. Evolution of Sound: Volume 1 (TikTok for Business) — TikTok
  7. 聲音商標申請須知 — 經濟部智慧財產局