当前位置: 首页 > wzjs >正文

如何申请开通网站企业网站怎么建立

如何申请开通网站,企业网站怎么建立,建行官网的网址是多少,网站名字词LightGBM 概述 一、LightGBM 简介二、LightGBM 原理详解⚙️ 核心原理🧠 LightGBM 的主要特点 三、LightGBM 实现步骤(Python)🧪 可调参数推荐完整案例代码(回归任务 可视化) 参考 LightGBM 是由微软开源的…

LightGBM 概述

  • 一、LightGBM 简介
  • 二、LightGBM 原理详解
    • ⚙️ 核心原理
    • 🧠 LightGBM 的主要特点
  • 三、LightGBM 实现步骤(Python)
    • 🧪 可调参数推荐
    • 完整案例代码(回归任务 + 可视化)
  • 参考

LightGBM 是由微软开源的 基于梯度提升框架(GBDT) 的机器学习算法,专为高性能、高效率设计,适用于大规模数据处理任务。它在准确率、训练速度和资源使用上都优于传统 GBDT 实现(如 XGBoost)。

一、LightGBM 简介

二、LightGBM 原理详解

⚙️ 核心原理

LightGBM 本质上是 Gradient Boosting Decision Tree(GBDT) 的一种高效实现。但它有两个关键创新:

1. 基于直方图的决策树算法(Histogram-based Algorithm)
将连续特征离散成固定数量的桶(bins),减少计算复杂度和内存占用。
计算增益时不再遍历所有可能的切分点,而是只在桶边界上寻找。

2. 叶子优先生长策略(Leaf-wise Tree Growth)
传统 GBDT 使用 Level-wise(按层生长) 方法。

LightGBM 使用 Leaf-wise(按叶节点增益最大优先扩展) 策略:

  • 每次选择增益最大的叶子节点扩展,导致更深的树。
  • 收敛更快,但可能更容易过拟合(需用 max_depth 控制)。

🧠 LightGBM 的主要特点

特性描述
高效率训练速度远快于 XGBoost 和传统 GBDT
内存占用低使用直方图压缩数据
支持类别特征无需独热编码,直接处理类别型特征
可扩展性强支持大数据、分布式训练
数据支持支持稀疏数据、缺失值自动处理

三、LightGBM 实现步骤(Python)

🧪 可调参数推荐

参数名含义说明
num_leaves树的最大叶子数值越大越容易过拟合
max_depth树的最大深度控制模型复杂度
learning_rate学习率越小越稳,但需要更多迭代
feature_fraction特征抽样率防止过拟合
bagging_fraction数据抽样率类似随机森林中的 bootstrap
lambda_l1 / lambda_l2正则项控制模型复杂度

完整案例代码(回归任务 + 可视化)

绘制的效果图如下:
在这里插入图片描述

左图:拟合效果:拟合曲线很好地捕捉了数据的非线性趋势。

  • 蓝点:训练数据
  • 红点:测试数据
  • 绿线:GBDT 拟合曲线

右图:残差图:残差应随机分布在 y=0 附近,没有明显模式,表明模型拟合良好。

输出结果为:

LightGBM Train MSE: 0.0581
LightGBM Test MSE: 0.0570

完整Python实现代码如下:

import numpy as np
import matplotlib.pyplot as plt
import lightgbm as lgb
from sklearn.model_selection import train_test_split
from sklearn.metrics import mean_squared_error# 设置字体
plt.rcParams['font.family'] = 'Times New Roman'# 1. 生成数据
np.random.seed(42)
X = np.linspace(0, 10, 200).reshape(-1, 1)
y = np.sin(X).ravel() + np.random.normal(0, 0.2, X.shape[0])# 2. 划分训练/测试集
X_train, X_test, y_train, y_test = train_test_split(X, y, test_size=0.2, random_state=42)# 3. 构造 LightGBM 数据集对象
train_dataset = lgb.Dataset(X_train, label=y_train)
test_dataset = lgb.Dataset(X_test, label=y_test, reference=train_dataset)# 4. 设置参数
params = {'objective': 'regression','metric': 'rmse','learning_rate': 0.1,'num_leaves': 15,'max_depth': 3,'verbose': -1,'seed': 42
}# 5. 训练 LightGBM 模型
model = lgb.train(params,train_dataset,num_boost_round=100,valid_sets=[train_dataset, test_dataset],valid_names=['train', 'test'],
)# 6. 预测与评估
y_train_pred = model.predict(X_train)
y_test_pred = model.predict(X_test)train_mse = mean_squared_error(y_train, y_train_pred)
test_mse = mean_squared_error(y_test, y_test_pred)print(f"LightGBM Train MSE: {train_mse:.4f}")
print(f"LightGBM Test MSE: {test_mse:.4f}")# 7. 可视化
plt.figure(figsize=(12, 6))# 7.1 拟合曲线图
plt.subplot(1, 2, 1)
plt.scatter(X_train, y_train, color='lightblue', label='Train Data', alpha=0.6)
plt.scatter(X_test, y_test, color='lightcoral', label='Test Data', alpha=0.6)X_all = np.linspace(0, 10, 1000).reshape(-1, 1)
y_all_pred = model.predict(X_all)
plt.plot(X_all, y_all_pred, color='green', label='LightGBM Prediction', linewidth=2)plt.title("LightGBM Model Fit", fontsize=15)
plt.xlabel("X", fontsize=14)
plt.ylabel("y", fontsize=14)
plt.legend()
plt.grid(True)# 7.2 残差图
plt.subplot(1, 2, 2)
train_residuals = y_train - y_train_pred
test_residuals = y_test - y_test_predplt.scatter(y_train_pred, train_residuals, color='blue', alpha=0.6, label='Train Residuals')
plt.scatter(y_test_pred, test_residuals, color='red', alpha=0.6, label='Test Residuals')
plt.axhline(y=0, color='black', linestyle='--')
plt.xlabel("Predicted y", fontsize=14)
plt.ylabel("Residuals", fontsize=14)
plt.title("Residual Plot", fontsize=15)
plt.legend()
plt.grid(True)plt.tight_layout()
plt.show()

参考

http://www.dtcms.com/wzjs/320231.html

相关文章:

  • 网站管理运营中文网站排行榜
  • 珠海澳门网站建设公司网络营销课程个人总结
  • 济宁专业做网站互联网app推广具体怎么做
  • 大学生做家教网站济南seo的排名优化
  • 口碑好的网站建设哪家好谷歌seo排名公司
  • 企业高端网站建设希爱力的功效及副作用
  • 2014 网站建设windows优化大师有毒吗
  • 网站访问流量怎么赚钱seo网站诊断方案
  • 尚易企业邮箱登录入口湖南网站营销seo多少费用
  • 做公号模版网站百度网游排行榜
  • 怎么用ps做网站效果图常州百度关键词优化
  • 广州网站建设鞍山优化百度涨
  • 做市场浏览什么网站惠州seo代理计费
  • 词典网站模板百度竞价被换着ip点击
  • 做网站学cdr吗seo技术服务外包公司
  • ui做网站实例网页制作代码模板
  • 药材公司网站建设模板长沙seo推广优化
  • 东莞市建设局网站全球十大搜索引擎排名及网址
  • 河源做网站优化seo标题优化是什么意思
  • 我想开网店需要怎么做福州seo网站排名
  • 第一次做ppt怎么弄怎么理解搜索引擎优化
  • 软件dw做网站百度云盘登录入口
  • dedecms做网站注意事项百度24小时人工客服
  • 做单挣钱的网站搜狗网站收录提交入口
  • 北京网站制作是什么哪个公司要做网络推广
  • php网站程序安装百度怎么推广自己的网站
  • jsp网站怎么做的好看武汉seo工厂
  • 新丰县建设局网站每天4元代发广告
  • 做个网站要花多少钱西安seo网络推广
  • 数据显示网站模板网络科技公司