or
本練習屬於課程
探索 Hugging Face 模型中心,將原始的文字、音訊與影像資料轉換成適合 AI 的格式。學習如何為文字生成等任務找到最新、最熱門的模型,並善用預先建置的 pipeline。
使用最先進的模型來掌握各種單一模態。深入電腦視覺的影像分類與分割,探索語音辨識與文字轉語音合成,並學習有效的微調技巧。運用 Hugging Face 的 transformers 函式庫中已訓練的模型,培養實作能力。
當前練習
學習融合視覺、文字與音訊資訊,打造更強大的 AI 應用。掌握像 CLIP 這樣的零樣本分類技術,建立能看也能讀的情緒分析器,並建立結合臉部表情與聲音的情感偵測器。讓你的 AI 模型超越單一模態的思維。
把點子變成現實!掌握最前沿的 AI 技術,使用文字提示詞來生成與操作視覺內容。建立驚豔的影像、智慧地編修照片,並打造適用於影像與文件的強大問答系統。用多模態 AI,將你的創意視覺化為數位成果。