§ 00 · where it happens 4 個你會「拍照求救」的時刻
這四個時刻發生時你會本能拿手機拍照:
1 · 國外餐廳菜單
你在京都某居酒屋,菜單全日文、店員不會英文。 想點魚但不知道哪一道有魚、想避開生肝但不知道哪行寫的是「レバ刺し」。
2 · 國外醫院 / 藥局
長輩從韓國回來帶了一袋藥。袋子上韓文寫滿,沒人知道哪顆是飯前哪顆飯後、能不能配酒、 能不能跟在台灣本來吃的藥併用。
3 · 衣服洗滌標
買了件 Made in Italy 的洋裝,標籤是義大利文 + 圖示。 能不能丟洗衣機?乾洗?冷水?
4 · 登山號誌、地鐵指引
太魯閣某條登山路線上看到標誌,多語並列但沒有中文。 走錯方向會多 3 小時。
這四個場景的共通點:視覺資訊 + 你不認得的文字 + 急著要懂。 一般翻譯機處理「文字 → 文字」,這個場景是「圖 → 解釋」 — 不一樣。
§ 01 · lens vs bot Google Lens vs LINE bot — 哪個適合什麼
Google Lens(內建在多數 Android)
- ✅ 拍照即時翻 — overlay 在原圖上。
- ✅ 免費、覆蓋語廣。
- ❌ 翻譯字面意思,不解釋上下文。
- ❌ 不能追問。
- ❌ 要切 App(從 LINE 出來進 Lens 再回 LINE)。
Google Translate App(拍照模式)
跟 Lens 類似 — 字面翻譯,沒上下文。要切 App。
vision-assist(LINE bot)
- ✅ 在 LINE 內,不切 App。
- ✅ 不只翻譯 — 解釋(這是什麼藥、能不能配酒、怎麼吃)。
- ✅ 可追問。「那如果我空腹吃?」、「跟降血壓藥併服可以嗎?」
- ✅ 對長輩友善 — 不用學新介面。
- ❌ 要付 credit。
- ❌ 比 Lens 慢一些(5–10 秒 vs 1 秒)— 因為要做語境推理而不只是 OCR。
§ 02 · follow up 可追問是 LINE bot 的關鍵差別
一般 OCR + 翻譯工具是「一次性對話」 — 拍張照、收結果、結束。 但實際使用情境裡,你拍完照後常有後續問題:
- 翻完菜單 → 「這道菜辣嗎?」
- 翻完藥袋 → 「能跟阿斯匹靈一起吃嗎?」
- 翻完洗滌標 → 「那如果我用 30 度水手洗呢?」
vision-assist 的設計核心是:第一張照片不是結束,是對話的開始。 bot 記得你剛才那張照片,後續追問都基於那張圖的內容回答。
這個差別在「藥袋 / 醫療」場景特別重要 — 一張藥袋資訊不夠時你會本能想問細節, 切 App 是大磨擦。
§ 03 · three examples 三個具體案例:菜單、藥袋、洗滌標
案例 1 · 京都居酒屋菜單
拍照、傳給 bot。bot 回:
- 「這份菜單 12 道菜。有魚的:刺身盛り合わせ、鯛茶漬け、鯖の塩焼き。」
- 「避開生肝:レバ刺し(生牛肝)、馬刺し(生馬肉,可選熟)」
- 「推薦的湯品:白味噌仕立て」
追問「哪一道最不油?」→ bot 回「白菜の煮浸し,蔬菜燉煮,無油」。
案例 2 · 韓國藥袋
拍照、傳給 bot。bot 回:
- 「藥袋上 5 種藥:降壓 ×2、抗組織胺 ×1、止痛 ×1、胃藥 ×1」
- 「劑量:早晚各 1 顆(除了止痛 PRN)」
- 「⚠️ 抗組織胺有嗜睡副作用,不要開車」
- 「⚠️ 止痛藥含 NSAID,不要空腹吃」
追問「能配紅酒嗎?」→ bot 回「不建議。降壓藥 + 酒精會加深降壓效果,可能頭暈。」
案例 3 · 義大利洋裝洗滌標
拍照、傳給 bot。bot 回:
- 「30°C 機洗(柔細模式)」
- 「不可烘乾」
- 「不可漂白」
- 「✅ 可中溫熨燙」
- 「成分:聚酯纖維 65% + 棉 35%」
§ 04 · older users 長輩怎麼用 — 給家裡安一支 vision-assist
vision-assist 在長輩家庭很有價值 — 但他們自己不會主動裝 bot。 做家屬的可以這樣安排:
step 1 · 你先在自己 LINE 安裝 vision-assist
熟悉它的回答邏輯,知道適合問什麼。
step 2 · 在「跟長輩的 1:1 chat」邀請 bot
長輩傳照片給你 → 同 chat 裡 bot 自動回答。 你不用先解讀,bot 已經解讀了。
step 3 · 教長輩拍清楚
告訴長輩:「拍藥袋 / 標籤 / 字小的東西時,鏡頭距離 30 公分、字要清楚」。 模糊的圖 bot 會回「請拍清楚一點 + 對焦在文字上」 — 不會強猜。
step 4 · 你來付 wallet
這個 chat × bot 的 wallet 你加值,長輩免費用。 連結就是 wallet — 你按一下加 100 元,長輩在這個 chat 用 bot 不會問你錢從哪來。