【商業大數據】AI商業大數據平台推廣說明會 (5/7)
發佈日期 :
2025-05-05
💐AI商業大數據平台推廣說明會💐
📅 時間: 2025/05/07 (三) 12:10 ~ 13:00
🏠 地點: 管理學院 3051 教室
👨 主持人: 資管系 康藝晃 副教授
👉 報名網址: https://forms.gle/chWfoEfpEPHzt4Gt6
👉 洽詢方式: 分機4515,電子郵件pa@cm.nsysu.edu.tw
隨著大數據技術與機器學習應用的迅速發展,Hadoop、Spark與Kubeflow已成為現代資料處理與模型開發中不可或缺的三大核心架構。
Hadoop提供可靠的分散式儲存與批次處理功能,能處理超過單一電腦或伺服器容量的大型資料集,彷彿一座協同運作的資料倉儲中心,而Spark則透過記憶體內運算機制,大幅減少磁碟讀寫時間,讓資料處理的速度實現數十倍提升,特別適合需要快速反覆運算的應用場景。
Kubeflow則進一步滿足機器學習開發者的需求,透過網頁介面即可快速建置可執行的 Notebook環境,不需自行部署開發環境與套件,並支援GPU資源配置,你可以依需求選擇熟悉的開發工具,如 JupyterHub、RStudio 或 CodeServer,並彈性調整所需的 CPU、RAM與儲存空間,整個流程如同開啟一間雲端工作室,讓開發與訓練工作在同一平台上進行。
對於從事資料分析或雲端運算的研究人員與實務工作者而言,理解這些技術的架構設計與應用場景至關重要,本次工作坊將結合理論與實作,內容包括:
Topic 1 : Hadoop 與 Spark 在分散式資料處理中的應用
- HDFS 基礎操作與 R 語言連線教學
- 巨量資料範例實作與效能分析
Topic 2 : 雲端機器學習平台 Kubeflow 操作實務
- Notebook 環境配置與 GPU 資源申請
- 開發環境操作(RStudio、JupyterHub、CodeServer)


分享
