当前位置: 首页 > wzjs >正文

在360网站上怎么做推广海淀区seo搜索引擎优化企业

在360网站上怎么做推广,海淀区seo搜索引擎优化企业,接单做公司网站站群,美发网站源码浙大疏锦行 DAY 31 文件的规范拆分和写法 知识点回顾 1. 规范的文件命名 2. 规范的文件夹管理 3. 机器学习项目的拆分 4. 编码格式和类型注解 作业:尝试针对之前的心脏病项目,准备拆分的项目文件,思考下哪些部分可以未来复用。 预处理&am…
@浙大疏锦行
DAY 31 文件的规范拆分和写法

知识点回顾

1.  规范的文件命名

2.  规范的文件夹管理

3.  机器学习项目的拆分

4.  编码格式和类型注解

作业:尝试针对之前的心脏病项目,准备拆分的项目文件,思考下哪些部分可以未来复用。

预处理:

import pandas as pd
import numpy as np
from typing import Tuple, Dictdef load_data(file_path: str) -> pd.DataFrame:"""加载数据文件Args:file_path: 数据文件路径Returns:加载的数据框"""return pd.read_csv(file_path)def handle_missing_values(data: pd.DataFrame) -> pd.DataFrame:"""处理缺失值Args:data: 包含缺失值的数据框Returns:处理后的数据框"""data_clean = data.copy()continuous_features = data.select_dtypes(include=['int64', 'float64']).columns.tolist()for feature in continuous_features:mode_value = data[feature].mode()[0]data_clean[feature].fillna(mode_value, inplace=True)return data_cleanif __name__ == "__main__":# 测试代码data = load_data(r"C:\Users\wangzhikai\Desktop\python60-days-challenge-master\day31练习\data\raw\heart.csv")data_clean = handle_missing_values(data)print("数据预处理完成!") 

训练:

# -*- coding: utf-8 -*-import sys
import os
sys.path.append(os.path.dirname(os.path.dirname(os.path.abspath(__file__))))from sklearn.ensemble import RandomForestClassifier
from sklearn.model_selection import train_test_split
from sklearn.metrics import classification_report, confusion_matrix
import time
import joblib # 用于保存模型
from typing import Tuple # 用于类型注解from data.preprocessing import load_data,handle_missing_valuesdef prepare_data() -> Tuple:"""准备训练数据Returns:训练集和测试集的特征和标签"""# 加载和预处理数据data = load_data(r"C:\Users\wangzhikai\Desktop\python60-days-challenge-master\day31练习\data\raw\heart.csv")data_clean = handle_missing_values(data)# 分离特征和标签X = data_clean.drop(['target'], axis=1)y = data_clean['target']# 划分训练集和测试集X_train, X_test, y_train, y_test = train_test_split(X, y, test_size=0.2, random_state=42)return X_train, X_test, y_train, y_testdef train_model(X_train, y_train, model_params=None) -> RandomForestClassifier:"""训练随机森林模型Args:X_train: 训练特征y_train: 训练标签model_params: 模型参数字典Returns:训练好的模型"""if model_params is None:model_params = {'random_state': 42}model = RandomForestClassifier(**model_params)model.fit(X_train, y_train)return modeldef evaluate_model(model, X_test, y_test) -> None:"""评估模型性能Args:model: 训练好的模型X_test: 测试特征y_test: 测试标签"""y_pred = model.predict(X_test)print("\n分类报告:")print(classification_report(y_test, y_pred))print("\n混淆矩阵:")print(confusion_matrix(y_test, y_pred))def save_model(model, model_path: str) -> None:"""保存模型Args:model: 训练好的模型model_path: 模型保存路径"""os.makedirs(os.path.dirname(model_path), exist_ok=True)joblib.dump(model, model_path)print(f"\n模型已保存至: {model_path}")if __name__ == "__main__":# 准备数据X_train, X_test, y_train, y_test = prepare_data()# 记录开始时间start_time = time.time()# 训练模型model = train_model(X_train, y_train)# 记录结束时间end_time = time.time()print(f"\n训练耗时: {end_time - start_time:.4f} 秒")# 评估模型evaluate_model(model, X_test, y_test)# 保存模型save_model(model, "models/random_forest_model.joblib") 

可视化:

import matplotlib.pyplot as plt
import seaborn as sns
import shap
import numpy as np
from typing import Anydef plot_feature_importance_shap(model: Any, X_test, save_path: str = None) -> None:"""绘制SHAP特征重要性图Args:model: 训练好的模型X_test: 测试数据save_path: 图片保存路径"""# 初始化SHAP解释器explainer = shap.TreeExplainer(model)shap_values = explainer.shap_values(X_test)# 绘制特征重要性条形图plt.figure(figsize=(12, 8))shap.summary_plot(shap_values[:, :, 0], X_test, plot_type="bar", show=False)plt.title("SHAP特征重要性")if save_path:plt.savefig(save_path)print(f"特征重要性图已保存至: {save_path}")plt.show()def plot_confusion_matrix(y_true, y_pred, save_path: str = None) -> None:"""绘制混淆矩阵热力图Args:y_true: 真实标签y_pred: 预测标签save_path: 图片保存路径"""plt.figure(figsize=(8, 6))cm = confusion_matrix(y_true, y_pred)sns.heatmap(cm, annot=True, fmt='d', cmap='Blues')plt.title('混淆矩阵')plt.ylabel('真实标签')plt.xlabel('预测标签')if save_path:plt.savefig(save_path)print(f"混淆矩阵图已保存至: {save_path}")plt.show()def set_plot_style():"""设置绘图样式"""plt.style.use('seaborn')plt.rcParams['font.sans-serif'] = ['SimHei']plt.rcParams['axes.unicode_minus'] = Falseif __name__ == "__main__":# 设置绘图样式set_plot_style()# 这里可以添加测试代码print("可视化模块加载成功!") 
http://www.dtcms.com/wzjs/235964.html

相关文章:

  • 大连响应式网站建设全球搜索引擎入口
  • 网站怎么换空间商上海培训机构
  • 运城做网站哪家好竞价推广账户托管费用
  • b2b网站推广快速排名点击工具
  • 微信手机网站app制作怎么让百度搜出自己
  • 营销4pseo如何快速排名百度首页
  • 知名网站制作公网络推广是做什么工作的
  • 随州网站建设外包公司视频号怎么推广流量
  • 想学习做网站青岛seo建站
  • asp.net mvc网站开发之美云南seo
  • 合肥做网站的公司讯登优化网站排名公司
  • 做问卷的网站生成二维码免费建站哪个比较好
  • 网站建设与网站制作哪些网站有友情链接
  • 网站注册搜索引擎的目的搜索引擎推广方案
  • 做网站的标性英文seo实战派
  • 用易语言做攻击网站软件下载百度手机怎么刷排名多少钱
  • 买完域名后怎么搭建个人网站seo的优点有哪些
  • 网站怎么做备案变更开创集团与百度
  • 服务器下载安装seo实战
  • 沧州网站建设刘磊网络营销师怎么考
  • wordpress插件木马吗百度优化教程
  • 公司网站页面设计图片如何在百度上发自己的广告?
  • 哈尔滨做网站公司哪家好电商培训内容
  • 学校网站建设学生文明上网哪里有免费的网站推广
  • 网站如何推广搜索引擎seo优化怎么做
  • 网站开发终止协议书贵阳网站建设制作
  • wordpress led主题seo优化与推广招聘
  • 医院网站建设运营方案搜索引擎名词解释
  • 做毕设网站多少钱需要推广的app在哪里找
  • wordpress科技网站模板淘宝关键词怎么优化