In [183]:
import numpy as np


def mse_loss(y_true, y_pred):
  # y_true и y_pred - массивы numpy одинаковой длины.
  return ((y_true - y_pred) ** 2).mean()


def sigmoid(x):
  # Наша функция активации: f(x) = 1 / (1 + e^(-x))
  return 1 / (1 + np.exp(-x))


def deriv_sigmoid(x):
  # Производная сигмоиды: f'(x) = f(x) * (1 - f(x))
  fx = sigmoid(x)
  return fx * (1 - fx)


class OurNeuralNetwork:
    '''
    Нейронная сеть с:
    - 2 входами
    - скрытым слоем с 2 нейронами (h1, h2)
    - выходной слой с 1 нейроном (o1)
    '''
    def __init__(self):
        # Веса
        self.w1 = np.random.normal()
        self.w2 = np.random.normal()
        self.w3 = np.random.normal()
        self.w4 = np.random.normal()
        self.w5 = np.random.normal()
        self.w6 = np.random.normal()

        # Пороги
        self.b1 = np.random.normal()
        self.b2 = np.random.normal()
        self.b3 = np.random.normal()

    def feedforward(self, x):
        # x is a numpy array with 2 elements.
        h1 = sigmoid(self.w1 * x[0] + self.w2 * x[1] + self.b1)
        h2 = sigmoid(self.w3 * x[0] + self.w4 * x[1] + self.b2)
        o1 = sigmoid(self.w5 * h1 + self.w6 * h2 + self.b3)
        return o1

    def train(self, data, all_y_trues):
        '''
        - data - массив numpy (n x 2) numpy, n = к-во наблюдений в наборе. 
        - all_y_trues - массив numpy с n элементами.
        Элементы all_y_trues соответствуют наблюдениям в data.
        '''
        learn_rate = 0.1
        epochs = 1000 # сколько раз пройти по всему набору данных 

        for epoch in range(epochs):
            for x, y_true in zip(data, all_y_trues):
                # --- Прямой проход (эти значения нам понадобятся позже)
                sum_h1 = self.w1 * x[0] + self.w2 * x[1] + self.b1
                h1 = sigmoid(sum_h1)

                sum_h2 = self.w3 * x[0] + self.w4 * x[1] + self.b2
                h2 = sigmoid(sum_h2)

                sum_o1 = self.w5 * h1 + self.w6 * h2 + self.b3
                o1 = sigmoid(sum_o1)
                y_pred = o1

                # --- Считаем частные производные.
                # --- Имена: d_L_d_w1 = "частная производная L по w1"
                d_L_d_ypred = -2 * (y_true - y_pred)

                # Нейрон o1
                d_ypred_d_w5 = h1 * deriv_sigmoid(sum_o1)
                d_ypred_d_w6 = h2 * deriv_sigmoid(sum_o1)
                d_ypred_d_b3 = deriv_sigmoid(sum_o1)

                d_ypred_d_h1 = self.w5 * deriv_sigmoid(sum_o1)
                d_ypred_d_h2 = self.w6 * deriv_sigmoid(sum_o1)

                # Нейрон h1
                d_h1_d_w1 = x[0] * deriv_sigmoid(sum_h1)
                d_h1_d_w2 = x[1] * deriv_sigmoid(sum_h1)
                d_h1_d_b1 = deriv_sigmoid(sum_h1)

                # Нейрон h2
                d_h2_d_w3 = x[0] * deriv_sigmoid(sum_h2)
                d_h2_d_w4 = x[1] * deriv_sigmoid(sum_h2)
                d_h2_d_b2 = deriv_sigmoid(sum_h2)

                # --- Обновляем веса и пороги
                # Нейрон h1
                self.w1 -= learn_rate * d_L_d_ypred * d_ypred_d_h1 * d_h1_d_w1
                self.w2 -= learn_rate * d_L_d_ypred * d_ypred_d_h1 * d_h1_d_w2
                self.b1 -= learn_rate * d_L_d_ypred * d_ypred_d_h1 * d_h1_d_b1

                # Нейрон h2
                self.w3 -= learn_rate * d_L_d_ypred * d_ypred_d_h2 * d_h2_d_w3
                self.w4 -= learn_rate * d_L_d_ypred * d_ypred_d_h2 * d_h2_d_w4
                self.b2 -= learn_rate * d_L_d_ypred * d_ypred_d_h2 * d_h2_d_b2

                # Нейрон o1
                self.w5 -= learn_rate * d_L_d_ypred * d_ypred_d_w5
                self.w6 -= learn_rate * d_L_d_ypred * d_ypred_d_w6
                self.b3 -= learn_rate * d_L_d_ypred * d_ypred_d_b3

        # --- Считаем полные потери в конце каждой эпохи
        if epoch % 10 == 0:
            y_preds = np.apply_along_axis(self.feedforward, 1, data)
            loss = mse_loss(all_y_trues, y_preds)
            print("Epoch %d loss: %.3f" % (epoch, loss))




In [184]:
# Определим набор данных
data = np.array([
  [-2, -1],  # Алиса
  [25, 6],   # Боб
  [17, 4],   # Чарли
  [-15, -6], # Диана
])
all_y_trues = np.array([
  1, # Алиса
  0, # Боб
  0, # Чарли
  1, # Диана
])

# Обучаем нашу нейронную сеть!
network = OurNeuralNetwork()
network.train(data, all_y_trues)

        
# Делаем пару предсказаний
emily = np.array([-7, -3]) # 52.35 кг, 160 см
frank = np.array([20, 2])  # 63.4 кг, 173 см
print("Эмили: %.3f" % network.feedforward(emily)) # 0.951 - Ж
print("Фрэнк: %.3f" % network.feedforward(frank)) # 0.039 - М

Эмили: 0.969
Фрэнк: 0.040


In [185]:
data = np.array([
    [(85 - 43) / (93 - 43), (192 - 158) / (192 - 158)],  # Иван
    [(50 - 43) / (93 - 43), (171 - 158) / (192 - 158)],  # Оля
    [(93 - 43) / (93 - 43), (175 - 158) / (192 - 158)],  # Петр
    [(43 - 43) / (93 - 43), (158 - 158) / (192 - 158)],  # Ира
    [(78 - 43) / (93 - 43), (165 - 158) / (192 - 158)],  # Роман
    [(47 - 43) / (93 - 43), (163 - 158) / (192 - 158)],  # Яна


])

all_y_trues = np.array([
    0,
    1,
    0,
    1,
    0,
    1,
])


network = OurNeuralNetwork()
network.train(data, all_y_trues)
emily = np.array([(52.35 - 43) / (93 - 43), (160 - 158) / (192 - 158)]) # 52.35 кг, 160 см
frank = np.array([(63.4 - 43) / (93 - 43), (173 - 158) / (192 - 158)])  # 63.4 кг, 173 см
print("Эмили: %.3f" % network.feedforward(emily)) # 0.951 - Ж
print("Фрэнк: %.3f" % network.feedforward(frank)) # 0.039 - М


Эмили: 0.912
Фрэнк: 0.450


In [186]:
def tanh(x):
    return np.tanh(x)


def deriv_tanh(x):
    return 1 - tanh(x) ** 2


sigmoid = tanh
deriv_sigmoid = deriv_tanh

data = np.array([
    [(85 - 43) / (93 - 43), (192 - 158) / (192 - 158)],  # Иван
    [(50 - 43) / (93 - 43), (171 - 158) / (192 - 158)],  # Оля
    [(93 - 43) / (93 - 43), (175 - 158) / (192 - 158)],  # Петр
    [(43 - 43) / (93 - 43), (158 - 158) / (192 - 158)],  # Ира
    [(78 - 43) / (93 - 43), (165 - 158) / (192 - 158)],  # Роман
    [(47 - 43) / (93 - 43), (163 - 158) / (192 - 158)],  # Яна

])

all_y_trues = np.array([
    0,
    1,
    0,
    1,
    0,
    1,
])


network = OurNeuralNetwork()
network.train(data, all_y_trues)
emily = np.array([(52.35 - 43) / (93 - 43), (160 - 158) / (192 - 158)]) # 52.35 кг, 160 см
frank = np.array([(63.4 - 43) / (93 - 43), (173 - 158) / (192 - 158)])  # 63.4 кг, 173 см
print("Эмили: %.3f" % network.feedforward(emily)) # 0.951 - Ж
print("Фрэнк: %.3f" % network.feedforward(frank)) # 0.039 - М


Эмили: 0.931
Фрэнк: 0.500
