現在流行的很多開源GPT訓練都以PyTorch來撰寫,例如特斯拉前研發主管Andrej karpathy (現職回歸OpenAI) 也都以PyTorch來撰寫nanoGPT。
本課程講師是擁有13年以上的AI產學經驗、並且任職上市公司人工智慧研發部副理的黃志勝老師,以業界需求的實務角度著眼,貼近初學者的心態著手,介紹完整的近代人工智慧,神經網路的模型學習技巧,例如參數初始和更新方式、梯度更新方式、損失函數等。以及網路架構的介紹,包含感知神經網路、卷積神經網路、和時序系列神經網路(RNN、LSTM、Transformer) 等,並帶著學員學習PyTorch的操作,詳述近代人工智慧應用與深度學習的相關技術。
什麼是 PyTorch?
PyTorch是一個基於Torch函式上,針對Python所開發的機器學習庫,為深度學習的框架之一,主要應用於電腦視覺和自然語言處理。
PyTorch 的設計目標是提供一個簡單易用、靈活且高效的工具,深受在深度學習領域的工作者的喜愛。它最大的核心功能是提供自動微分,幫助開發人員可以更容易地定義和優化神經網絡模型。同時,PyTorch的動態計算圖表更貼近Python風格的編程,因此更易於開發和調試。你可以使用標準的Python語句進行調試,並且更容易理解和檢查中間結果。
另一個特點是會使用動態計算圖表。相較於其他框架 (TensorFlow),PyTorch的計算圖是在運行時就構建的,表示計算會在每一行程式碼都完成後執行,使得使用者可以更靈活地進行模型構建和調試。此外,PyTorch還支援多GPU平行加速,可以加快模型訓練的速度。