ChatGPT Voice 學術英文教練:我用每小時 0.85 元把「時薪 2,000 元的老師」拐回家
大學時,我請過每小時 NT$2,000 的語言家教。多年後,我把 ChatGPT Voice「拐」進手機,隨時練習國際會議的臨場 Q&A。
本篇目錄
我請過最貴的語言家教,每小時 NT$2,000。那是大學時;那個價格,我到現在都沒忘。
很多年後,我又替自己找了一位英文陪練。只是這一次,我把它「拐」進手機裡:不用約時間,等我有十幾分鐘,就能立刻開始。
讓我留下它的原因,是「必須預約一小時」和「有十幾分鐘就能開始」之間的門檻差異。
國際會議有人突然追問時,我需要練的是能不能在幾秒內開始回答。
論文看得懂,文字也寫得出來;真正卡住的是腦中有答案,嘴巴卻來不及把它組出來。
睡前跟讀可以先準備句子,卻無法模擬一個沒有預告、還會繼續追問的人。
於是我把原本的 shadowing 和 ChatGPT Voice 分工:
- Shadowing 負責把句子吃進嘴巴。
- Voice 負責在壓力下把句子拿出來。
Shadowing 和 Voice 練的是兩件事
我的 shadowing 流程很簡單:
- Listen:先聽懂一小段。
- Shadow:跟著原音講兩次。
- Retell:關掉字幕,用自己的話重述。
- Own:把句型換到自己的工作情境。
一段只取 20–40 秒,可以連續用三到五天。
這套方法適合建立句庫、節奏與發音,但題目是我自己選的,下一句大多也能預測。
Conference Q&A 會突然質疑研究設計、追問限制,或把話題轉去我沒有準備的地方;它測的是能不能立即提取。
| Shadowing | ChatGPT Voice | |
|---|---|---|
| 主要任務 | 句庫、節奏、對原音自校發音 | 不可預測提取、壓力下組句 |
| 對話形式 | Solo、內容可預期 | 互動、可以繼續追問 |
| 一開始的設計 | 每天 3–8 分鐘 | 每週 2–3 次,每次不超過 15 分鐘 |
| 練完接著做 | 把句型帶進對談 | 把卡住的句子帶回跟讀 |
普通的 AI 家教,很容易讓人感覺良好
一開始我真正花時間的不是選聲音,而是寫教練規則。
如果只說「請當我的英文老師」,AI 很容易出現四種行為:
| 常見狀況 | 我加上的規則 |
|---|---|
| 不管怎麼說都先稱讚 | 禁止以稱讚開頭,直接進入內容或訂正 |
| 聽得懂就算通過 | 錯誤固定用「原句/修正/理由」指出 |
| 回答愈來愈舒服 | 答得順時,下一題要更具體、更尖銳 |
| AI 一直解釋,我變成聽眾 | AI 一般對談每回合最多約三句,我應占約 70% 說話時間 |
我的訂正格式固定成:
X: 我原本說的句子
→ 一位專業同事會使用的自然版本
why: 一句說明文法、搭配詞或語氣問題
示範
X: We discussed about the results.
→ We discussed the results.
why: discuss 後面直接接討論的內容,不加 about。
接著請我用修正後的句型再說一句。一次最多修三項。
優先修會讓聽者誤解臨床或統計意思的錯,再處理場合不合的語氣,最後才是冠詞、介系詞與其他細節。
每次開始前,先請它列出上次留下的錯誤。找不到紀錄,我就貼回上次的練習摘要,從那裡接著練。
一次性設定,先不要塞滿資料
1. 建一個獨立 Project
我開一個專門練英文的 Project,把教練規則與練習紀錄放在一起。先貼好文末的 Prompt,就可以開始第一場;素材之後再加。
2. 貼入教練規則
完整 starter Prompt 放在文末收合附錄。
儲存後,我會先用文字問:
請用三點說明:你會怎麼訂正我、我應該占多少說話時間,
以及你會在結束時留下哪些練習紀錄。
合格的回答應該:
- 沒有從稱讚開始。
- 說得出
X / → / why的格式。 - 知道我應該占約 70% 的說話時間。
- 會留下錯誤、可重用表達與下次練習的紀錄。
如果這四點沒有出現,我先檢查 instructions 是否真的保存完整,不在每一場重新補一長串規則。
3. 第一場可以完全不上傳檔案
第一場先口頭介紹自己的研究即可。需要素材時,我會選一份已公開的摘要或簡報,讓問題更貼近實際上台的情境。
第一場只練一種壓力
我把第一種模式設成學術 Q&A。
題目選一份我真的上台講過、也有公開投影片的研究。這比拿一篇陌生文章練習更接近真實情況:內容本來就熟,真正被測到的是能不能當場表達。
一場可以這樣跑:
- 我先講兩分鐘。
- AI 扮演 skeptical audience。
- 一次只問一題。
- 我回答後,訂正、重講,再繼續追問。
- 十到十五分鐘就結束。
- 最後輸出 ERROR LOG。
意思不清楚時,先追問我想表達什麼;訂正後,再讓我用自己的話說一次,才進下一題。
語言課堂研究也讓我注意到「誰來完成修正」這件事。Lyster 與 Saito 的統合分析發現,提示學習者自己修正,比直接把正確句子重述給他聽,有更大的效果。因此,我想把教練規則再往前推一步:訂正後,讓我自己重講一次。研究來源
除了 Q&A,我保留兩種常用模式:
- Small talk:模擬 conference reception,對方要有自己的意見,也可以自然轉題。
- Explain it plainly:把專業概念說給非專家聽,找出我在哪裡繞太遠或術語太多。
Small talk 專門練最難啟動的前 30 秒:自我介紹、開場與第一個自然問題,不用臨場從零組裝。
ERROR LOG 要回流,但不要變成第二份作業
每場結束時,我要求教練留下四項:
Repeated errors:
New errors:
Phrases I should steal and reuse:
Next session, quiz me on:
但我不會把每一場 log 全部抄進另一套筆記。
抄寫義務一變重,練口說很容易變成整理資料。我的規則是:
- 每週只挑一個真正可重用的句子,送回 shadowing。
- 同一錯誤連續三週出現,才進長期頑固錯誤清單。
- 下次開場先練上次留下的一個錯誤。
Project 裡的對話留下練習過程,長期筆記只收反覆出現的問題。
把第一段錄音留下來
我另外錄一段固定條件的回答,留作之後比較的基準。
我可以看著同一份投影片,因為真實簡報本來就有投影片;但不能看講稿、念投影片或錄到滿意為止。
我錄下第一段兩分鐘的回答。之後用同一題、同樣的準備時間再錄,放在一起聽:是否更快開口、理由能不能說完整,以及卡住時能否換句話說。
接下來也可以換一道沒練過的追問,看看熟悉的表達能不能用到新問題上。
隨時可用,也可能永遠不開始
真人課有預約,AI 沒有。
我的第一版安排是每場 10–15 分鐘,漏掉就接著下一次;四週後再看實際練了幾次。如果連四次都不到,就改成固定時段。
後來才需要的事:一份 Prompt 變成兩個教練
最初我只做英文教練,後來才延伸成日文版:英文練學術答辯,日文練日本 GI 場域的交流與敬語。兩者分開放在不同 Project,共用的訂正規則則整理成 Language Coach Kit,方便一起更新。更多分工放在我會三種語言,為什麼反而不能共用一個 AI 教練?(尚未公開)。
如果現在只做一件事
在開始練習以前,先錄第一段兩分鐘 baseline;然後用同一題完成一場十分鐘的 Voice Q&A。
我想練的,是腦中有答案時,嘴巴也能跟得上。ChatGPT Voice 讓我多了一個隨時能開始的練習方式:講一段、接受追問、修一句,再重新說一次。
想直接照做:Starter Prompt 與第一場開場句
把方括號換成自己的情境,貼進 Project instructions。
# ROLE
You are my English speaking coach for [MY REAL SCENARIO].
My goal is to respond clearly and professionally under time pressure.
# HARD RULES
1. Never begin a reply with praise. Start with substance or correction.
2. If my answer is unclear, ask one focused question before suggesting a rewrite.
For a clear error in grammar, wording, or register, correct it in this format:
X: [what I said]
→ [a natural professional version]
why: [one short reason]
If there was no meaningful error, say "clean" and continue.
Do not invent errors.
After a meaningful correction, ask me to say the sentence again in my own words before moving on.
3. Correct at most three items per turn. Prioritize:
- errors that change the meaning of my professional claim
- register that does not fit the setting
- collocations, articles, and prepositions
4. Keep normal conversation turns to three sentences.
For corrections, use the brief X / → / why format and address at most three items.
I should do about 70% of the speaking.
5. Ask one question at a time.
Do not give me the model answer before I try.
6. If I answer easily, make the next question more specific or challenging.
Do not lower the difficulty just to keep me comfortable.
7. Stay in English unless I explicitly ask for Chinese.
8. If you cannot actually see a previous session log, say so.
Never pretend to remember an earlier error.
9. Be honest about pronunciation.
Only tell me when you genuinely heard the wrong word or were uncertain.
Do not claim to score my accent precisely.
# END OF SESSION
Always output:
SESSION LOG - [date]
Mode:
What I practised:
Repeated errors:
New errors:
Phrases I should steal and reuse:
Next session, quiz me on:
儲存後先用文字測試:
Explain only these three things:
your correction format, how much I should speak,
and what you will include in the session log.
第一場開場句:
Q&A drill.
I will explain [TOPIC] for two minutes.
Then act as a skeptical audience member and ask one question at a time.
If my answer is unclear, ask me to clarify first.
After correcting a meaningful error, ask me to say it again before the next question.
Do not show me the model answer first.
After ten minutes, stop and give me the session log.
操作說明:Voice 官方說明|Projects 官方說明。