概要
在 EP6 我們聊了機器人如何「模仿」人類,但如果有些動作連人類都做不出來,或我們希望機器人能青出於藍,該怎麼辦?
答案,就是曾擊敗世界棋王的 AlphaGo 背後的核心技術——「強化學習」(RL)。RL 的概念就像在教一個小孩或寵物:它不需要你手把手示範,而是讓它在虛擬世界中不斷嘗試,做對了就給「獎勵」,做錯了就得到「懲罰」,直到它自己摸索出最佳策略。
這種「練功」方式雖然需要驚人的算力,但隨著技術進步,它正為機器人開啟一扇通往「自主學習」與「超人智慧」的大門。
-----
歡迎收聽與訂閱 科技超充站
📌 SoundOn: https://sndn.link/tech-supercharger
📌 Spotify: https://open.spotify.com/show/6ToSFF6FLFMkn6Hhq8LrSu
📌 Apple Podcast: https://podcasts.apple.com/podcast/1822117677
📌 KKBOX: https://podcast.kkbox.com/tw/channel/-lfGCM78JxsIaOMcSN
--
Hosting provided by SoundOn