神经网络基础-神经网络补充概念-12-向量化逻辑回归的梯度输出

代码实现

python 复制代码
import numpy as np

def sigmoid(z):
    return 1 / (1 + np.exp(-z))

def compute_loss(X, y, theta):
    m = len(y)
    h = sigmoid(X.dot(theta))
    loss = (-1/m) * np.sum(y * np.log(h) + (1 - y) * np.log(1 - h))
    return loss

def compute_gradient(X, y, theta):
    m = len(y)
    h = sigmoid(X.dot(theta))
    gradient = X.T.dot(h - y) / m
    return gradient

def batch_gradient_descent(X, y, theta, learning_rate, num_iterations):
    m = len(y)
    losses = []
    
    for _ in range(num_iterations):
        gradient = compute_gradient(X, y, theta)
        theta -= learning_rate * gradient
        
        loss = compute_loss(X, y, theta)
        losses.append(loss)
        
    return theta, losses

# 生成一些模拟数据
np.random.seed(42)
m = 100
n = 2
X = np.random.randn(m, n)
X = np.hstack((np.ones((m, 1)), X))
theta_true = np.array([1, 2, 3])
y = (X.dot(theta_true) + np.random.randn(m) * 0.2) > 0

# 初始化参数和超参数
theta = np.zeros(X.shape[1])
learning_rate = 0.01
num_iterations = 1000

# 执行批量梯度下降(向量化)
theta_optimized, losses = batch_gradient_descent(X, y, theta, learning_rate, num_iterations)

# 打印优化后的参数
print("优化后的参数:", theta_optimized)

# 绘制损失函数下降曲线
import matplotlib.pyplot as plt
plt.plot(losses)
plt.xlabel('迭代次数')
plt.ylabel('损失')
plt.title('损失函数下降曲线')
plt.show()

我们首先定义了 compute_gradient 函数,它计算梯度向量。然后,在 batch_gradient_descent 函数中使用向量化的梯度计算,从而避免了循环操作。

这种向量化的梯度计算方法可以有效地处理多个样本,从而提高代码的性能。

相关推荐
wordbaby13 分钟前
混合检索:两全其美的艺术
人工智能·算法
Amy1870211182321 分钟前
数据中心电气接点测温:从“被动抢修”到“主动预警”的安全革命
人工智能·安全
jimmyleeee35 分钟前
GEN AI安全:威胁全景---从训练到运行的攻防实战
人工智能·安全
阿里云大数据AI技术1 小时前
DataWorks Data Agent 实战课堂(八):数据质量巡检服务
人工智能·agent
昇腾知识体系1 小时前
昇腾 A5 ISA 指令集:文档入口与 mem_bar 等关键指令
人工智能·华为·架构·知识图谱
ltqvibe1 小时前
让AI操作业务系统,误删数据谁来拦
人工智能·数字员工管理·高危操作拦截·ai审计追责
oscar9991 小时前
Ollie:Opik 内置的 AI 助手,让 Agent 调试从“看”变成“修”
人工智能·opik·ollie
wshzd1 小时前
LLM漫谈(十一)| 5 个 开源Agent 源码剖析
人工智能
酒旅Agent开发实战1 小时前
酒店供应链MCP实践分享
人工智能·大模型·酒店预订·ai agent·mcp