待辦太多
AI 生成語音 · gemini-3.1-flash-tts-preview · 聲線 Puck
「作業還沒交,報告也還沒寫。等一下是不是又要開會?時間怎麼又不夠了,先做哪一件啊?」
本課程原創腳本,使用 Gemini TTS 製作;非真人現場錄音,非 Freesound / CC 素材。外在聲景使用真實現場錄音與擬音錄音;I THINK 使用五段 AI 生成的內在獨白。這裡可以直接試聽每一段素材,查看錄音者、原始頁面、授權與本網站的修改方式。
David Sonnenschein · Sound Spheres — A Psychospatial Model
本作品依據陳嘉暐老師提供的教材改編,保留 I THINK、I AM、I TOUCH、I SEE、I KNOW、I DON'T KNOW 六個層次。它們描述你與聲音的關係,而不是固定的物理距離。I THINK 先用五段 AI 碎念呈現內在紛擾,逐一關閉後回到安靜;I SEE 的可見聲源由情境想像設定,應回到現場觀察;若未知聲音被你認出,可以把它移到 I KNOW。
| 場景 | 真實素材與情境設定 |
|---|---|
| 郵局・寄出一封信 | 紙張、印章與郵局交談。郵局底景錄於芬蘭,這是寄信情境重構,並非台灣郵局實錄。 |
| 台北・街角午後 | 真實台北街頭雙耳錄音,結合阿里山鳥蟲聲,重構樹蔭下的城市聆聽位置;各聲音並非同地同時錄製。 |
| 演唱會・謝幕人海 | 真實掌聲、歡呼與另錄的觀眾交談;設定為歌曲之間的謝幕時刻,不播放商業歌曲。 |
| 音樂廳・開演之前 | 真實樂團調音、節目單紙張與觀眾交談;設定為開演前,不是交響曲完整演出。 |
| 阿里山・林間慢行 | 阿里山清晨、溪流與特殊叫聲,加上其他錄音者的林間腳步;屬於多素材聲景重構。 |
手機版以一頁式簡報呈現:球體、目前層次與操作按鈕保持在同一畫面。開始體驗時,五個不同聲線的日常煩惱循環交疊。使用者可以逐一關閉,或一鍵全部安放;全部關閉後,才解鎖 I AM 與五種外在聲景。暫停只停止播放,不代表關閉念頭。可從中心按「重新聽見它們」,或在最後一頁按「再走一次」重新開始。
這五段是 AI 生成的內在獨白,外在環境聲仍使用真實錄音。交疊營造注意力擁擠的感覺,並非以過大的聲壓製造刺激。下方可分別聽清楚每段語音。
AI 生成語音 · gemini-3.1-flash-tts-preview · 聲線 Puck
「作業還沒交,報告也還沒寫。等一下是不是又要開會?時間怎麼又不夠了,先做哪一件啊?」
本課程原創腳本,使用 Gemini TTS 製作;非真人現場錄音,非 Freesound / CC 素材。AI 生成語音 · gemini-3.1-flash-tts-preview · 聲線 Kore
「剛剛那句話是不是說錯了?他怎麼還沒回訊息?是不是在生我的氣?早知道就不要那樣講了。」
本課程原創腳本,使用 Gemini TTS 製作;非真人現場錄音,非 Freesound / CC 素材。AI 生成語音 · gemini-3.1-flash-tts-preview · 聲線 Fenrir
「別人都已經做完了,我怎麼還卡在這裡?如果做得不好怎麼辦?再改一下,再改一下,還是不夠好。」
本課程原創腳本,使用 Gemini TTS 製作;非真人現場錄音,非 Freesound / CC 素材。AI 生成語音 · gemini-2.5-flash-preview-tts · 聲線 Laomedeia
「鑰匙放哪裡?手機是不是快沒電了?等一下要買什麼?晚餐吃什麼?欸,我剛剛到底要做什麼?」
本課程原創腳本,使用 Gemini TTS 製作;非真人現場錄音,非 Freesound / CC 素材。AI 生成語音 · gemini-2.5-flash-preview-tts · 聲線 Achird
「明天會順利嗎?萬一出錯怎麼辦?下個月的計畫呢?要不要先想一個備案?還是再想一個?」
本課程原創腳本,使用 Gemini TTS 製作;非真人現場錄音,非 Freesound / CC 素材。Read only the exact Traditional Chinese transcript in natural Taiwan Mandarin. Perform a private inner monologue: quick, restless, slightly anxious, conversational muttering, close and dry. Clearly intelligible rather than breathy whispering. Do not shout, sing, add words, or include music or sound effects. Use varied pacing with small hesitations, like everyday worries circling in the mind.
2026-09-07 製作;語音經基本等化、響度校正與結尾留白,再轉為 MP3。目標 −20 LUFS / −3 dBTP;逐段實測值見 生成紀錄 JSON。網站播放採固定立體聲位置、交錯起點與平滑靜音,並於輸出端控制峰值。語音檔已預先生成,學生不需 API 或帳號。
共 14 個來源,製作成 17 段網站音訊。除 akx 的郵局環境音採 CC BY 4.0,其餘為 CC0 1.0。授權依原始音效頁於 2026-09-07 的標示記錄;錄音者的署名與原始連結逐項列於下方。作者並未因此背書本網站。
stamp post office mail.wav
錄音:frank_the_noise · CC0 1.0 · 原始音效頁 ↗
本網站版本:剪輯、循環接點與響度校正;播放時調整音量與左右位置。2021-11-29-taipei-ambience-day-okm-II-zoom-h5-008.wav
錄音:ilmari_freesound · CC0 1.0 · 原始音效頁 ↗
本網站版本:剪輯、循環接點與響度校正;播放時調整音量與左右位置。forest footsteps
錄音:nathanmanaker · CC0 1.0 · 原始音效頁 ↗
本網站版本:剪輯、循環接點與響度校正;已裁去原始音檔開頭 5 秒並重建循環接點;播放時調整音量與左右位置。從 Freesound 公開高品質 MP3 試聽版本取得錄音,選取適合的片段,去除極低頻雜訊,製作循環交叉淡化,並逐檔校正響度。目標為約 −18 LUFS、真峰值預留空間(目標 −2 dBTP),保留音色與自然動態;尖峰較明顯的素材可能略低於目標。播放端另有動態壓縮與柔性峰值限制,避免多層混音疊加削波。
逐層前進時,只點亮並播放目前的一圈,其他層保持安靜。到達最外圈後,按「全部亮起」才進入第七頁,六層一起發聲;此時可以重新包含內在語音,也可取消「包含內在聲音」,讓中心保持安靜。換場景會保留目前層次,筆記、音量與設定則在主畫面上以面板開啟。原本的程序振盪器與噪聲合成已全部移除。Gemini 輔助辨識與篩選真實錄音,並透過 TTS 額外製作五段 I THINK 內在語音;外在聲景沒有使用 AI 生成環境音。
立體聲錄音保留原有左右差異,並按情境做輕微聲像調整。除來源明確標示的台北雙耳錄音,不宣稱其他素材是雙耳錄音、頭部追蹤或實測三維音場。「聆聽真實環境」會關閉所有播放音訊。
以上教材由授課教師提供供本專案參考。圖像與字型無外部依賴;筆記只存在使用者的瀏覽器。網站不啟用麥克風,不上傳筆記,不需要 API 金鑰。