or
本练习是课程的一部分
浏览 Hugging Face 模型中心,将原始文本、音频和视觉数据转换为适合 AI 处理的格式。学习如何为文本生成等任务找到最新最热门的模型,并充分利用预构建的 pipeline。
使用最先进的模型掌握各个单一模态。深入学习用于图像分类与分割的计算机视觉,探索语音识别与文本转语音合成,并掌握高效的微调技巧。基于 Hugging Face transformers 库中的预训练模型构建实用技能。
融合视觉、文本与音频信息,打造更强大的 AI 应用。掌握如 CLIP 等零样本分类技术,构建"能看也能读"的情感分析器,并创建结合面部表情与语音的情绪检测器。让您的 AI 模型跳出单一模态的局限。
当前练习
把创意变为现实!掌握前沿 AI 技术,使用文本提示生成与编辑视觉内容。创建令人惊艳的图像、智能编辑照片,并为图像与文档构建强大的问答系统。借助多模态 AI,将您的创意愿景转化为数字现实。