|
| 商品編號: | DUE4150 |
|
| 商品名稱: | Udemy線上課程 (Ken Cen出品)Generative AI第 31 部 多模態融合:視覺+語言模型深入解析 (上) 講師:瞭解更多 影音教學 中文發音 |
|
| 商品分類: | Udemy線上課程綜合教學 |
|
| 語系版本: | 中文發音 繁體中文版 | |
| 商品類型: | Ken Cen出品 | |
| 運行平台: | 官方原版畫質MP4檔,沒有任何平台限制,終身使用 | |
| 更新日期: | 2026-08-20 |
|
| 光碟片數: | 1片DVD光碟 |
|
| 銷售價格: | $200元 |
|
| 熱門標籤: | Udemy線上課程
AI第
| |
|
|
Udemy線上課程 (Ken Cen出品)Generative AI第 31 部 多模態融合:視覺+語言模型深入解析 (上) 講師:瞭解更多 影音教學 中文發音 繁體中文版(DVD版)
一般 AI 模型都是隻能處理某個功能。
例如,語言模型 & 圖像模型。
而隨著 AI 時代的發展,多模態模型誕生了。
它能夠同時處理多種不同的輸入信息。
本課程將介紹如下將 用戶的 Prompt & 圖像輸入,分別用 Vison Transformer 和 Tokenizer 捕捉當中的內容,同時,結合兩種的Embedding ,並輸入到 Gemma 模型當中處理。
課程內容如下:什麼是對比學習 & 為什麼需要SigLIP & 什麼是Vision Transformer如何 Pytorch 編寫Siglilp Vision Transformer如何處理 Embedding 到Patches & 什麼是 Batch Norm 和 Layer Norm如何編寫多模態模型的注意力機制代碼如何處理輸入 Image 和輸入 Prompt 並合併在一起如何製作 PaliGemma 多模態模型並導入權重為推理做準備
01 - 課程環境準備
001 加入Udemy 全球最大的中文 AI 課程.mp4
002 課程工具準備.mp4
003 如何使用uv 作為包管理器和項目管理工具.mp4
02 - 什麼是對比學習 & 為什麼需要SigLIP & 什麼是Vision Transformer
001 什麼是對比學習 & 為什麼需要SigLIP & 什麼是Vision Transformer.mp4
03 - 如何使用 Pytorch 編寫Siglilp Vision Transformer
001 如何使用 Pytorch 編寫Siglilp Vision Transformer.mp4
002 如何處理 Embedding 到Patches & 什麼是 Batch Norm 和 Layer Norm.mp4
003 如何編寫多模態模型的注意力機制代碼.mp4
04 - 如何處理輸入 Image 和輸入 Prompt 並合併在一起
001 如何處理輸入 Image 和輸入 Prompt 並合併在一起.mp4
002 如何製作 PaliGemma 多模態模型並導入權重為推理做準備.mp4
002 Resources
002 0_paligemma.zip
|
|