跳到主要內容區


【商業大數據】AI商業大數據平台推廣說明會 (5/7)

發佈日期 : 2025-05-05

💐AI商業大數據平台推廣說明會💐

📅  時間: 2025/05/07 (三) 12:10 ~ 13:00

🏠  地點: 管理學院 3051 教室

👨  主持人: 資管系 康藝晃 副教授

👉  報名網址: https://forms.gle/chWfoEfpEPHzt4Gt6

👉  洽詢方式: 分機4515,電子郵件pa@cm.nsysu.edu.tw

隨著大數據技術與機器學習應用的迅速發展,Hadoop、Spark與Kubeflow已成為現代資料處理與模型開發中不可或缺的三大核心架構。

Hadoop提供可靠的分散式儲存與批次處理功能,能處理超過單一電腦或伺服器容量的大型資料集,彷彿一座協同運作的資料倉儲中心,而Spark則透過記憶體內運算機制,大幅減少磁碟讀寫時間,讓資料處理的速度實現數十倍提升,特別適合需要快速反覆運算的應用場景。

Kubeflow則進一步滿足機器學習開發者的需求,透過網頁介面即可快速建置可執行的 Notebook環境,不需自行部署開發環境與套件,並支援GPU資源配置,你可以依需求選擇熟悉的開發工具,如 JupyterHub、RStudio 或 CodeServer,並彈性調整所需的 CPU、RAM與儲存空間,整個流程如同開啟一間雲端工作室,讓開發與訓練工作在同一平台上進行。

對於從事資料分析或雲端運算的研究人員與實務工作者而言,理解這些技術的架構設計與應用場景至關重要,本次工作坊將結合理論與實作,內容包括:

Topic 1 : Hadoop 與 Spark 在分散式資料處理中的應用

  • HDFS 基礎操作與 R 語言連線教學
  • 巨量資料範例實作與效能分析

Topic 2 : 雲端機器學習平台 Kubeflow 操作實務

  • Notebook 環境配置與 GPU 資源申請
  • 開發環境操作(RStudio、JupyterHub、CodeServer)