AI說書 - 從0開始 - 278 | 模型視覺化極限與人為介入

發佈於三分鐘學AI (2)

更新於 2024/12/27發佈於 2024/12/27閱讀時間約 2 分鐘

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。

Transformer 模型的解釋已經取得了進展，但仍有許多工作要做，有些絆腳石仍然相當具有挑戰性：

Embedding Sublayer 基於隨機計算，並添加到複雜的 Positional Encoding 中
多頭注意力機制的隨機性使得很難確定為什麼以及如何在經過多層處理後，一個 Token 的得分脫穎而出
對原始輸出應用 Softmax 函數會模糊其過程
Dropout 子層會抹去部分過程痕跡
深度學習中的正則化技術，如 ReLU 和 GELU，會阻礙對輸出的逆向工程

人工評估仍然是評估和尋找幫助提高透明度的方法的關鍵資源，解釋人工智慧的壓力越來越大，正在推動解釋工具向前發展，在專案層面你會發現很多好的例子和糟糕的結果，關注好的例子來了解 Transformer 如何透過語言學習。

#PromptEngineering

#chatgpt怎麼用

Learn AI 不 BI三分鐘學AI (2)AI從0開始-第九章

留言

留言分享你的想法！

Learn AI 不 BI

225會員

648內容數

這裡將提供： AI、Machine Learning、Deep Learning、Reinforcement Learning、Probabilistic Graphical Model的讀書筆記與演算法介紹，一起在未來AI的世界擁抱AI技術，不BI。

Learn AI 不 BI的其他內容

2024/12/28

AI說書 - 從0開始 - 279 | 第九章額外閱讀

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。從 AI說書 - 從0開始 - 247 | 第九章引言到 AI說書 - 從0開始 - 278 | 模型視覺化極限與人為介入，我們完成書籍：Transformers f

2024/12/28

AI說書 - 從0開始 - 279 | 第九章額外閱讀

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。從 AI說書 - 從0開始 - 247 | 第九章引言到 AI說書 - 從0開始 - 278 | 模型視覺化極限與人為介入，我們完成書籍：Transformers f

2024/12/26

AI說書 - 從0開始 - 277 | OpenAI Transformer 模型之視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。延續 AI說書 - 從0開始 - 275 | OpenAI Transformer 模型之視覺化及 AI說書 - 從0開始 - 276 | OpenAI Transf

2024/12/26

AI說書 - 從0開始 - 277 | OpenAI Transformer 模型之視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。延續 AI說書 - 從0開始 - 275 | OpenAI Transformer 模型之視覺化及 AI說書 - 從0開始 - 276 | OpenAI Transf

2024/12/25

AI說書 - 從0開始 - 276 | OpenAI Transformer 模型之視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。延續 AI說書 - 從0開始 - 275 | OpenAI Transformer 模型之視覺化的操作，以下繼續：我們可以提出一個更好的解釋，並要求查看得分細節，這些

2024/12/25

AI說書 - 從0開始 - 276 | OpenAI Transformer 模型之視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。延續 AI說書 - 從0開始 - 275 | OpenAI Transformer 模型之視覺化的操作，以下繼續：我們可以提出一個更好的解釋，並要求查看得分細節，這些

你可能也想看

阿千看世界

2025年綜合所得稅繳稅教學：線上申報、信用卡回饋、拆單攻略！

每年4月、5月都是最多稅要繳的月份，當然大部份的人都是有機會繳到「綜合所得稅」，只是相當相當多人還不知道，原來繳給政府的稅！可以透過一些有活動的銀行信用卡或電子支付來繳，從繳費中賺一點點小確幸！就是賺個１%~2%大家也是很開心的，因為你們把沒回饋變成有回饋，就是用卡的最高境界所得稅線上申報

#2025所得稅#綜合所得稅#繳稅有回饋

2025/05/03

阿千看世界

2025年綜合所得稅繳稅教學：線上申報、信用卡回饋、拆單攻略！

每年4月、5月都是最多稅要繳的月份，當然大部份的人都是有機會繳到「綜合所得稅」，只是相當相當多人還不知道，原來繳給政府的稅！可以透過一些有活動的銀行信用卡或電子支付來繳，從繳費中賺一點點小確幸！就是賺個１%~2%大家也是很開心的，因為你們把沒回饋變成有回饋，就是用卡的最高境界所得稅線上申報

#2025所得稅#綜合所得稅#繳稅有回饋

2025/05/03

科技巨頭解碼

NVDA 25Q1 財報 - 扣除中國因素，輝達的前方仍然沒有烏雲 | #276

全球科技產業的焦點，AKA 全村的希望 NVIDIA，於五月底正式發布了他們在今年 2025 第一季的財報 (輝達內部財務年度為 2026 Q1，實際日曆期間為今年二到四月)，交出了打敗了市場預期的成績單。然而，在銷售持續高速成長的同時，川普政府加大對於中國的晶片管制......

#NVDA#NVIDIA#輝達

2025/06/18

科技巨頭解碼

NVDA 25Q1 財報 - 扣除中國因素，輝達的前方仍然沒有烏雲 | #276

全球科技產業的焦點，AKA 全村的希望 NVIDIA，於五月底正式發布了他們在今年 2025 第一季的財報 (輝達內部財務年度為 2026 Q1，實際日曆期間為今年二到四月)，交出了打敗了市場預期的成績單。然而，在銷售持續高速成長的同時，川普政府加大對於中國的晶片管制......

#NVDA#NVIDIA#輝達

2025/06/18

Learn AI 不 BI

AI說書 - 從0開始 - 318 | Embedding 模型描述

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。回顧目前手上有的素材：載入文本並執行 Tokenization：AI說書 - 從0開始 - 314 | 載入文本並執行 Tokenization 文本處理以降低

#AI#ai#PromptEngineering

2025/02/07

Learn AI 不 BI

AI說書 - 從0開始 - 318 | Embedding 模型描述

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。回顧目前手上有的素材：載入文本並執行 Tokenization：AI說書 - 從0開始 - 314 | 載入文本並執行 Tokenization 文本處理以降低

#AI#ai#PromptEngineering

2025/02/07

Learn AI 不 BI

AI說書 - 從0開始 - 277 | OpenAI Transformer 模型之視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。延續 AI說書 - 從0開始 - 275 | OpenAI Transformer 模型之視覺化及 AI說書 - 從0開始 - 276 | OpenAI Transf

#AI#ai#PromptEngineering

2024/12/26

Learn AI 不 BI

AI說書 - 從0開始 - 277 | OpenAI Transformer 模型之視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。延續 AI說書 - 從0開始 - 275 | OpenAI Transformer 模型之視覺化及 AI說書 - 從0開始 - 276 | OpenAI Transf

#AI#ai#PromptEngineering

2024/12/26

Learn AI 不 BI

AI說書 - 從0開始 - 276 | OpenAI Transformer 模型之視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。延續 AI說書 - 從0開始 - 275 | OpenAI Transformer 模型之視覺化的操作，以下繼續：我們可以提出一個更好的解釋，並要求查看得分細節，這些

#AI#ai#PromptEngineering

2024/12/25

Learn AI 不 BI

AI說書 - 從0開始 - 276 | OpenAI Transformer 模型之視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。延續 AI說書 - 從0開始 - 275 | OpenAI Transformer 模型之視覺化的操作，以下繼續：我們可以提出一個更好的解釋，並要求查看得分細節，這些

#AI#ai#PromptEngineering

2024/12/25

Learn AI 不 BI

AI說書 - 從0開始 - 274 | Transformer 模型之 LIT 視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。我們在 AI說書 - 從0開始 - 271 | 其他解釋 Transformer 模型之方法簡介中，提到 LIT 視覺化，今天我們來操作一次，首先造訪：https:/

#AI#ai#PromptEngineering

2024/12/22

Learn AI 不 BI

AI說書 - 從0開始 - 274 | Transformer 模型之 LIT 視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。我們在 AI說書 - 從0開始 - 271 | 其他解釋 Transformer 模型之方法簡介中，提到 LIT 視覺化，今天我們來操作一次，首先造訪：https:/

#AI#ai#PromptEngineering

2024/12/22

Learn AI 不 BI

AI說書 - 從0開始 - 273 | Transformer 模型之 LIT 視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。我們在 AI說書 - 從0開始 - 271 | 其他解釋 Transformer 模型之方法簡介中，提到 LIT 視覺化，今天我們來操作一次，首先造訪：https:/

#AI#ai#PromptEngineering

2024/12/21

Learn AI 不 BI

AI說書 - 從0開始 - 273 | Transformer 模型之 LIT 視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。我們在 AI說書 - 從0開始 - 271 | 其他解釋 Transformer 模型之方法簡介中，提到 LIT 視覺化，今天我們來操作一次，首先造訪：https:/

#AI#ai#PromptEngineering

2024/12/21

Learn AI 不 BI

AI說書 - 從0開始 - 272 | Transformer 模型之 LIT 視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。我們在 AI說書 - 從0開始 - 271 | 其他解釋 Transformer 模型之方法簡介中，提到 LIT 視覺化，今天我們來操作一次，首先造訪：https:/

#AI#ai#PromptEngineering

2024/12/19

Learn AI 不 BI

AI說書 - 從0開始 - 272 | Transformer 模型之 LIT 視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。我們在 AI說書 - 從0開始 - 271 | 其他解釋 Transformer 模型之方法簡介中，提到 LIT 視覺化，今天我們來操作一次，首先造訪：https:/

#AI#ai#PromptEngineering

2024/12/19

Learn AI 不 BI

AI說書 - 從0開始 - 270 | 互動式 Transformer 視覺化介面

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。在 AI說書 - 從0開始 - 269 | 互動式 Transformer 視覺化介面中，闡述了一項視覺化介面，其例子如下：在 Transformer 架構中

#AI#ai#PromptEngineering

2024/12/17

Learn AI 不 BI

AI說書 - 從0開始 - 270 | 互動式 Transformer 視覺化介面

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。在 AI說書 - 從0開始 - 269 | 互動式 Transformer 視覺化介面中，闡述了一項視覺化介面，其例子如下：在 Transformer 架構中

#AI#ai#PromptEngineering

2024/12/17

Learn AI 不 BI

AI說書 - 從0開始 - 269 | 互動式 Transformer 視覺化介面

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。我們在 AI說書 - 從0開始 - 266 | Transformer 視覺化透過 Dictionary Learning 中，介紹了 Dictionary Learn

#AI#ai#PromptEngineering

2024/12/16

Learn AI 不 BI

AI說書 - 從0開始 - 269 | 互動式 Transformer 視覺化介面

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。我們在 AI說書 - 從0開始 - 266 | Transformer 視覺化透過 Dictionary Learning 中，介紹了 Dictionary Learn

#AI#ai#PromptEngineering

2024/12/16

Learn AI 不 BI

AI說書 - 從0開始 - 268 | 互動式 Transformer 視覺化介面

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。我們在 AI說書 - 從0開始 - 266 | Transformer 視覺化透過 Dictionary Learning 中，介紹了 Dictionary Learn

#AI#ai#PromptEngineering

2024/12/15

Learn AI 不 BI

AI說書 - 從0開始 - 268 | 互動式 Transformer 視覺化介面

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。我們在 AI說書 - 從0開始 - 266 | Transformer 視覺化透過 Dictionary Learning 中，介紹了 Dictionary Learn

#AI#ai#PromptEngineering

2024/12/15

Learn AI 不 BI

AI說書 - 從0開始 - 253 | Attention 模型視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。如果我們想要獲得 Transformer 的模型觀點，只需要撰寫以下程式碼： model_view(attention, tokens, sentence_b_sta

#AI#ai#PromptEngineering

2024/11/18

Learn AI 不 BI

AI說書 - 從0開始 - 253 | Attention 模型視覺化

我想要一天分享一點「LLM從底層堆疊的技術」，並且每篇文章長度控制在三分鐘以內，讓大家不會壓力太大，但是又能夠每天成長一點。如果我們想要獲得 Transformer 的模型觀點，只需要撰寫以下程式碼： model_view(attention, tokens, sentence_b_sta

#AI#ai#PromptEngineering

2024/11/18

追蹤感興趣的內容從 Google News 追蹤更多 vocus 的最新精選內容追蹤 Google News