類神經網路訓練訓練機器分類與Cross-entropy

更新於 2024/05/01發佈於 2024/05/01閱讀時間約 1 分鐘

Classification 可以使用Regression來實作嗎？

我們可以透過使用one-hot vector表示不同的類別。假設有三個類別我們需要區分，這時候我們不使用單純的數字1, 2, 3，而是改用向量[1 0 0]^T, [0 1 0]^T, [0 0 1]^T，藉此就能避免掉1與2比較相似，1與3比較不相似的問題。

但要如何從原本輸出一個數值，進化到輸出三個數值形成向量呢？

透過乘上不同的Weight和加上不同的bias就能得到一個數值，那同樣如果要得到三個數值形成向量，就找出三組W與Bias。

但除此之外，我們還會額外通過softmax的方式，得到最終的y'值。目的是為了更方便與類別向量做比較，類別向量只有1跟0的數字，softmax可以做到normalize的過程，最後就會得到0~1的數值。

計算方法：將y值取exp之後，除以所有exp y值的總和。（像是比較權重？！）

y' = softmax(y) = exp(y_i) / exp(y₁)+exp(y₂)+exp(y₃)

Cross-entropy

雖然在計算loss時可以透過MSE，但大多數在分類的資料訓練時都會利用Cross-entropy來計算類別的loss，會更加適合。-> 有時候MSE會training不起來，但Cross entropy的斜率會比較平均。

Cross entropy計算loss的方法：L(y') = -Σŷ_ilny_i'

Cross-entropy

dab戴伯的沙龍

1會員

37內容數

留言

留言分享你的想法！

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

‌

‌
‌

dab戴伯的沙龍的其他內容

深度學習優化中的動態學習率

瞭解梯度下降算法中的學習速率調整，包括為什麼需要動態的學習速率、Root Mean Square、RMSProp、最常用的optimization策略Adam，以及如何進行Learning rate Scheduling。

#學習 #權重 #Adam

深度學習中的Batch與Momentum

本文將介紹batch的定義與其在機器學習中的作用，以及不同batch size 的影響。同時也會講解Momentum動量在機器學習中的重要性。透過本文，您將清楚地瞭解batch、batch size和Momentum動量的概念以及其對機器學習的影響。

#學習

類神經網路訓練局部最小值 (local minima) 與鞍點 (saddle point)

之前有提到有時我們在微分之後會得到gradient = 0的值，就以為我們已經找到最小值，但其實它只是local minima。那這一節主要想跟大家分享我們要怎麼區分是不是Local Minima。

深度學習基本概念簡介（下）

這篇文章介紹瞭如何使用sigmoid函數來解決函數過於簡單導致的模型偏差問題，並透過尋找函數和參數來逼近precise linear curve。另外，也講述瞭如何尋找讓損失函數最小的參數以及使用batch和反覆進行Sigmoid的方法。

#學習

機器學習基本概念簡介（上）

機器學習是什麼? 簡單來說，機器學習就是訓練機器尋找Function的一段過程，而這個Function可以幫助我們解決我們遇到的問題，或是幫助我們

靜態類與(Static)以及內存洩漏問題

static 關鍵字主要用於管理記憶體，可用在variables, methods, blocks, nested classed。加上static關鍵字的物件，會在啟動程式當下就會賦予記憶體位置給此物件，後續無論實例化多少次，記憶體的位置都相同。以class舉例，static class 與

深度學習優化中的動態學習率

#學習 #權重 #Adam

深度學習中的Batch與Momentum

#學習

類神經網路訓練局部最小值 (local minima) 與鞍點 (saddle point)

深度學習基本概念簡介（下）

#學習

機器學習基本概念簡介（上）

機器學習是什麼? 簡單來說，機器學習就是訓練機器尋找Function的一段過程，而這個Function可以幫助我們解決我們遇到的問題，或是幫助我們

你可能也想看

國泰世華CUBE App 美的生活體驗，給予你最好的情緒。

現代社會跟以前不同了，人人都有一支手機，只要打開就可以獲得各種資訊。過去想要辦卡或是開戶就要跑一趟銀行，然而如今科技快速發展之下，金融App無聲無息地進到你生活中。但同樣的，每一家銀行都有自己的App時，我們又該如何選擇呢？(本文係由國泰世華銀行邀約) 今天我會用不同角度帶大家看這款國泰世華CUB

#國泰世華 #CUBE卡 #金融

JayRay 的沙龍

2024/08/07

【資料分析】資料分析起手式，理解數據並使用python找到資料間的關聯

在資料分析過程中，透過衡量變數之間的線性或非線性關係，能有效探索數據集，篩選出重要特徵，並進行預測建模。本文介紹瞭如何理解數據、使用相關矩陣找出變數關聯性，以及利用互資訊評估變數之間的依賴程度，幫助資料科學家在建模過程中選擇適當的變數，提升模型效果。

#數據 #資訊 #模型

JayRay 的沙龍

2024/08/01

【資料分析】python資料處理-類別欄位轉換基礎操作語法彙整

本文介紹了在進行資料分析時，將類別欄位轉換為數值欄位的方法，包括Label Encoding、One-Hot Encoding、Binary Encoding、Target Encoding和Frequency Encoding。每種方法的應用範例、優缺點和適用場景都有詳細說明。

#數據 #順序 #模型

柴郡貓姍蒂的沙龍

2024/07/23

筆記-深度學習模型訓練：利用殘差網路做影像辨識

前言讀了許多理論，是時候實際動手做做看了，以下是我的模型訓練初體驗，有點糟就是了XD。正文 def conv(filters, kernel_size, strides=1): return Conv2D(filters, kernel_size,

#深度學習 #AI #人工智慧

ysf的沙龍

2024/07/08

The Nature of Code閱讀心得與Python實作：1.6 Normalizing Vectors

本節介紹向量的正規化。

#python #Python #PYTHON

螃蟹_crab的沙龍

2024/05/25

[深度學習][Python]使用簡單的神經網路來訓練辨識fashion_mnist資料

本文主要介紹神經網路訓練辨識的過程，利用fashion_mnist及簡單的神經網路來進行分類。使用只有兩層的神經網路來訓練辨識fashion_mnist資料。

　　經過三篇的進展，我們目前實作的網路已經能做到同時訓練多種風格，且後續可以直接進行轉換，不用重新訓練，但是這種方法畢竟還是受到了預訓練的風格制約，無法跳脫出來，那麼有什麼辦法能夠讓他對於沒學過的風格也有一定的反應能力呢?

#AI #StyleTransform #Pytorch

高中數學主題練習—標準化計算

語言模型與文字表示以不同的方式來分析自然語言的詞語分佈及語意關係。本文章簡要介紹了語言模型、Word2vec、FastText、GloVe和Transformer等技術，並提供了實際的應用參考點，幫助讀者深入理解自然語言處理的技術。

#模型 #語言 #輸入

高中數學主題練習—相關係數計算

這篇文章以簡單易懂的文字和圖片介紹線性混和效應模型，包含其中的元素和意義。除此之外也透過 R 的實作具體呈現操作時的情況。

#線性回歸 #線性混和效應模型 #統計

MIA的宇宙

2025/01/09

國泰世華CUBE App 美的生活體驗，給予你最好的情緒。

#國泰世華 #CUBE卡 #金融

JayRay 的沙龍

2024/08/07

【資料分析】資料分析起手式，理解數據並使用python找到資料間的關聯

#數據 #資訊 #模型

JayRay 的沙龍

2024/08/01

【資料分析】python資料處理-類別欄位轉換基礎操作語法彙整

#數據 #順序 #模型

柴郡貓姍蒂的沙龍

2024/07/23

筆記-深度學習模型訓練：利用殘差網路做影像辨識

#深度學習 #AI #人工智慧

ysf的沙龍

2024/07/08

The Nature of Code閱讀心得與Python實作：1.6 Normalizing Vectors

本節介紹向量的正規化。

#python #Python #PYTHON

螃蟹_crab的沙龍

2024/05/25

[深度學習][Python]使用簡單的神經網路來訓練辨識fashion_mnist資料

本文主要介紹神經網路訓練辨識的過程，利用fashion_mnist及簡單的神經網路來進行分類。使用只有兩層的神經網路來訓練辨識fashion_mnist資料。

#AI #StyleTransform #Pytorch

高中數學主題練習—標準化計算

#模型 #語言 #輸入

高中數學主題練習—相關係數計算

這篇文章以簡單易懂的文字和圖片介紹線性混和效應模型，包含其中的元素和意義。除此之外也透過 R 的實作具體呈現操作時的情況。

#線性回歸 #線性混和效應模型 #統計

類神經網路訓練 訓練機器分類與Cross-entropy

Cross-entropy

類神經網路訓練訓練機器分類與Cross-entropy