成片
74 秒.1920×1088.9 個鏡頭加上 2 張結尾字卡.畫面右上角全程標示「AI 生成」
9 個鏡頭(依分鏡表)
每一列是一個鏡頭的開頭、中段、結尾畫面
| # | 分鏡 | 台詞/旁白(分鏡表原文) | 地端語音辨識核對 |
|---|---|---|---|
| 1 | 工地遠景,徐先生走進來 | 旁白:大林慈濟醫院啟業前,一個週末早晨…… | ✅ |
| 2 | 動力中心,看著指標很困惑 | 院長室……到底在哪裡? | ✅ |
| 3 | 樓梯轉角的廁所,院長彎腰刷洗 | 咦?這位師兄是? | ✅ |
| 4 | 問路 | 師兄歹勢,請問院長室要往哪裡走?/院長室?你往前走,再右轉就到了。 | ✅ 兩句都有 |
| 5 | 臨時辦公室,等待面試 | 旁白:徐先生順利找到臨時辦公室,等待面試。 | ✅ |
| 6 | 院長穿著西裝走進來 | 你好,我是院長林俊龍。 | ✅ |
| 7 | 徐先生瞪大眼睛,指著院長 | 啊!您……您不是剛才在掃廁所的師兄嗎? | ✅ |
| 8 | 院長自然地微笑 | 對啊。 | ✅ |
| 9 | 兩人相視而笑,畫面淡出 | 字幕:沒想到,會有人到廁所裡來問路! | ⚠️ 應該只有笑聲,但辨識出疑似多餘的字詞,已經把音量壓低 |
參考素材

林院長(授權照片,裁成單人)

林院長(授權照片,裁成單人)

徐先生(沒有照片,先用 AI 生成一張定裝照,讓 9 個鏡頭長相一致)

大林慈院啟業前的工地(授權照片)
製作紀錄
- 先抽卡、再完整生成:9 個鏡頭先用低解析度快速生成(每個約 1 分鐘),逐一檢查畫面,並用地端語音辨識核對台詞,都沒問題了才跑 1080p,全部約 47 分鐘。
- 重抽了 3 個鏡頭:
- S2:模型自己把台詞燒成字幕,換 seed 重抽。
- S8:第二張院長照片的賑災帳篷背景被學進畫面,而且多了一段語音。改成只用第一張照片。
- S9:冒出分鏡裡沒有的台詞,換 seed 重抽。
- 避開上人的照片:素材中有 2 張照片有證嚴上人入鏡,分鏡裡沒有上人,所以這 2 張沒有拿來當參考圖。
- 後製:片名、字幕、AI 標示、靜思語結尾卡用 Pillow 做成圖片、再用 ffmpeg 合成。字幕時間是依照每個鏡頭長度估算的,沒有逐字對齊。
- 硬體:RTX Pro 6000 全程滿載,溫度最高 85°C,GPU 錯誤(Xid)0 筆。