Deep Learning μ΄λ 무μμΈκ°? Hidden Layer λ 무μμΈκ°? μ΄λ° κ°λ
μ κ°λ¨ν μ΄ν΄νκ³ μλκ°? μ μ₯μ μμ λ₯Ό μ΄ν΄λ³΄λ©΄ 1X784 λ°μ΄ν°μ 784X10 μ¨μ΄νΈ λ°μ΄ν°μ 10κ°μ λ°μ΄μμ€λ₯Ό μ¬μ©νμ¬ hypothesis statesλ₯Ό κ³μ°νκ³ νμ±ν ν¨μ Softmaxλ₯Ό μ μ©νμ¬ Cross Entropy Cost ν¨μλ₯Ό κ΅¬μ± ν Optimizerλ₯Ό μ€μ νμ¬ κ²½μ¬νκ°λ²μ μ μ©νκ² λλ€. μ¬κΈ°μ Dense(128)μ²λΌ μλμΈ΅μ΄ μΆκ°λ λ One layer λ§νΌ Deep ν΄μ‘λ€κ³ νλ©° μ΄λμ λμ
λλ μ¨μ΄νΈ λ§€νΈλ¦μ€μ ν¬κΈ°κ° 128X10 μ΄λΌλ©΄ 128 λ§νΌ Wide ν΄μ‘λ€κ³ λ³Ό μ μλ€. μ¦ 784X10 μ¨μ΄νΈ λ§€νΈλ¦μ€ μ¬μ©μμ (784X128) κ³Ό (128X10) μ΄ κ³±ν΄μ§ λ§νΌμ μ¨μ΄νΈ λ§€νΈλ¦μ€κ° μ¬μ©λλ κ²μ΄λ€. μ΄ μ¨μ΄νΈλ€μ μ΄κΈ°μ λλ€λλ²λ₯Ό μ¬μ©νλ―λ‘ free parameterλΌκ³ λΆλ₯΄κΈ°λ νλ€. μ¦ MNIST λ¬Έμ λ λ°μ΄μμ€ ν¬ν¨ 7850κ°μ νλΌλ©ν°λ€μ΄ μ¬μ©λλ©° 128 μλμΈ΅μ΄ μ¬μ©λλ μμ μμλ 785X128+(128+1)X10=101,770κ°μ νλΌλ©ν°κ° μ¬μ©λλ μ
μ΄λ€. νλΌλ©ν° μκ° λ§μμλ‘ νμ΅ν¨μ¨μ΄ λμμ§κ³ μΈμλ₯ μ΄ ν₯μλλ κ²½ν₯μ΄ μλ€.
μλ URL μ£Όμλ‘ μ΄λνμ¬ λ§μ μ½μ΄ 보μΈμ.
http://blog.daum.net/ejleep1/945
![λ§λλ§μΈλ‘κ³ .png]
