线性回归既是一种数据挖掘与建模算法,也是统计学领域、计量经济学领域的常用学术建模方法,有何不同?

一.线性回归的基本形式

线性回归既是一种数据挖掘与建模算法,也是统计学领域、计量经济学领域的常用学术建模方法。在数据挖掘与建模领域,线性回归算法是一种较为基础的机器学习算法,其基本思想是将响应变量(因变量、被解释变量)和特征变量(自变量、解释变量、因子、协变量)描述成线性关系。

二.统计学领域、计量经济学领域的线性回归

统计学领域、计量经济学领域的线性回归主要关心的是估计的系数αβ,尤其是β,通过观察β的系数方向、大小以及是否具有统计学显著性,来验证参与分析的经济变量之间的关系,比如提升通货膨胀率是否有助于降低失业率等等。所以,对于β系数估计的有效性是比较高的。在构建线性回归方程、应用最小二乘法估计回归方程系数时,需要满足以下假设条件:

1) 假定特征之间无多重共线性。

2) 误差项之间相互独立,且均服从同一正态分布。

3) 误差项满足与特征之间的严格外生性假定。

4) 误差项满足自身的同方差假定。

5) 误差项满足自身的无自相关假定。

如果不满足这些假设条件,那么最小二乘法的适用性、估计系数的有效性就难以保证,从而学术研究的规范性也会受到质疑。

三.数据挖掘与建模领域的线性回归

而在数据挖掘与建模应用方面,模型致力于商业预测,比如研究客户的产品购买行为与年收入水平等变量之间的关系等,线性回归主要关心的是响应变量的实际值y与拟合值之间的差值是否足够小,特征变量的线性组合是否可以有效预测响应变量,因此,即使数据不满足那些假设条件,线性回归也可以积极使用,只要预测效果可以让人接受甚至令人非常满意,那么模型就可以被认为是适用的,可以用来进行预测。

响应变量的变化可以由α+βX组成的线性部分和随机误差项ε部分来解释。对于线性模型,一般采用最小二乘估计法来估计参数αβ,最小二乘估计法的基本原理是使残差平方和最小,残差就是响应变量的实际值y与拟合值之间的差值,其中响应变量的实际值y即为样本观测值的实际y值,而响应变量的拟合值即为基于样本观测值的实际X值以及估计出来的参数αβ。通过α+βX计算得到的、预测出来的值。

四.线性模型具有一定的稳定性

线性模型具有一定的稳定性。从技术角度来看,我们在评价模型的优劣时,通常从两个维度去评判,一是模型预测的准确性,二是模型预测的稳健性,两者相辅相成、缺一不可。关于模型预测的准确性,如果模型尽可能地拟合了历史数据信息,拟合优度很高,损失的信息量很小,而且对于未来的预测都很接近真实的发生值,那么这个模型一般被认为是质量较高的。而关于模型的稳健性,我们期望的是模型在对训练样本以外的样本进行预测时,模型的预测精度不应该有较大幅度的下降。一般来说,神经网络、决策树的预测准确性要优于线性回归、判别分析和Logistic回归分析等线性分析,但是其稳健性弱于线性分析。

五.统计分析、数据分析、挖掘方面有三个主流分支:统计学、计量经济学、机器学习

很多朋友问我,零基础如何入门统计分析、数据分析、数据挖掘?我想说的是:统计分析、数据分析、挖掘方面有三个主流分支:统计学、计量经济学、机器学习。这三个学科有所交叉,但也各自有侧重点。每个学校、每个专业具体情况不一样,但大多数都会选择其中一门或多门作为核心。根据我多年的教学经验,大家无论是学机器学习还是统计学、计量经济学,都建议结合着具体的软件或来学,对于不想走纯科研路线或者想成为理论大牛的大多数朋友来说,不建议过多研究数学公式,而是应一边学习知识原理,一遍上手操作,不然就会在复杂的推导面前耗尽了所有的学习热情。目前学习统计学实现工具最好用最流行的就是SPSS,学习计量经济学实现工具最好用最流行的就是Stata,而机器学习实现工具最好用最流行的就是Python,也比较好入手。所以,推荐学一门编程语言Python,加两个统计分析软件Stata、SPSS,这样几乎可以胜任统计分析与数据科学的各种场景,无论是在校搞学术还是职场搞数据都绰绰有余。

六.如何学习Python/SPSS/Stata?

在学习Python/SPSS/Stata时也不能光看视频,而是应该拿到具体的案例、源代码,一边学习一边操作,不断从学习中获得成就感,才会事半功倍,不然学了半天很容易学了就忘,那些代码估计也记不住,所以还是具体找些书好好的系统学习下。那么学习统计分析与数据科学应该看什么书?
1、《Python数据科学应用从入门到精通》张甜 杨维忠编著 清华大学出版社 2023年 适用于Python基础教学、数据分析、数据挖掘与建模、数据可视化、数据清洗等教学。国务院发展研究中心创新发展研究部第二研究室主任杨超 ,山东大学经济学院金融系党支部书记、副主任、副教授、硕士生导师张博,山东管理学院信息工程学院院长 袁锋 教授、硕士生导师,山东大学经济学院 刘一鸣 副研究员、硕士生导师,得厚投资合伙人 张伟民等一众大牛联袂推荐。

2、《Python机器学习原理与算法实现》杨维忠 张甜编著 清华大学出版社 2023年 适用于Python基础教学、数据分析、数据挖掘与建模、机器学习等教学。恒丰银行总行副行长郑现中,山东大学经济学院教学实验中心主任 副教授 韩振,德勤华永会计师事务所 华文伟 合伙人,首创证券深圳分公司机构业务部 樊磊 总经理 中国准精算师,山东省农村信用社联合社数据管理项目组 郝路安 总监等一众大牛联袂推荐。

3、《Stata统计分析从入门到精通》杨维忠 张甜编著 清华大学出版社 2022年 适用于Stata计量经济学、统计分析教学。国内计量大牛、山东大学陈强教授作序推荐,长期占据当当、京东、淘宝同类图书畅销榜前列。国内众多高校作为核心专业课程教材。

4、《Stata统计分析商用建模与综合案例精解》杨维忠 张甜编著 清华大学出版社 2021年 适用于Stata计量经济学、统计分析教学。国内众多高校作为核心专业课程教材。在51CTO举办的“2021年度最受读者喜爱的IT图书作者评选”中,《Stata统计分析商用建模与综合案例精解》荣获“数据科学领域最受读者喜爱的图书TOP5”。

5、《SPSS统计分析入门与应用精解(视频教学版)》杨维忠 张甜编著 清华大学出版社 2022年 适用于SPSS统计分析教学。同为国内计量大牛、山东大学陈强教授作序推荐,长期占据当当、京东、淘宝同类图书畅销榜前列。国内众多高校作为核心专业课程教材。

6、《SPSS统计分析商用建模与综合案例精解》杨维忠 张甜编著 清华大学出版社 2021年 适用于SPSS统计分析教学。国内众多高校作为核心专业课程教材。在51CTO举办的“2021年度最受读者喜爱的IT图书作者评选”中,《SPSS统计分析商用建模与综合案例精解》荣获“数据科学领域最受读者喜爱的图书TOP5”。

京东、当当、淘宝各大平台均在热销中,搜索书名即可。

创作不易,恳请大家多多点赞支持!也欢迎大家关注我,让我们一起学习Stata、SPSS、Python知识。多谢!

本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.hqwc.cn/news/239084.html

如若内容造成侵权/违法违规/事实不符,请联系编程知识网进行投诉反馈email:809451989@qq.com,一经查实,立即删除!

相关文章

【Node.js】笔记梳理 8 - API和JWT

写在最前:跟着视频学习只是为了在新手期快速入门。想要学习全面、进阶的知识,需要格外注重实战和官方技术文档,文档建议作为手册使用 系列文章 【Node.js】笔记整理 1 - 基础知识【Node.js】笔记整理 2 - 常用模块【Node.js】笔记整理 3 - n…

浅析SD-WAN企业组网部署中简化网络运维的关键技术

网络已经成为现代企业不可或缺的基础设施,它为企业提供了连接全球的桥梁。随着全球化和数字化转型的加速推进,企业面临着越来越多的网络挑战和压力。传统的网络组网方式往往无法满足企业规模扩大、分支机构增多、上云服务等需求,导致网络性能…

Windows11系统下内存占用率过高如何下降

. # 📑前言 本文主要是win11系统下CPU占用率过高如何下降的文章,如果有什么需要改进的地方还请大佬指出⛺️ 🎬作者简介:大家好,我是青衿🥇 ☁️博客首页:CSDN主页放风讲故事 🌄每日…

重要通知丨 JumpServer 开源堡垒机 V2 社区版即将停止维护

尊敬的 JumpServer 开源堡垒机用户,您好! 根据《关于 JumpServer 开源堡垒机 V2 版本产品生命周期的相关说明》,JumpServer 开源堡垒机 V2 版本(社区版)将于 2023 年 12 月 31 日停止维护支持。 在过去的两年多时间里…

Linux 系统是如何收发网络包的?(计算机网络)

一、Linux 网络协议栈 如下是TCP/IP四层网络模型,实际上Linux 网络协议栈与它相似 下图是Linux 网络协议栈 二、Linux 接收网络包的流程 1.网卡是计算机里的一个硬件,专门负责接收和发送网络包,当网卡接收到一个网络包后,会通过…

11.28 C++作业

提示并输入一个字符串&#xff0c;统计该字符中大写、小写字母个数、数字个数、空格个数以及其他字符个数 要求使用C风格字符串完成 #include <iostream>using namespace std;int main() {string str;cout << "请输入一个字符串&#xff1a;" <<…

基于若依的ruoyi-nbcio流程管理系统仿钉钉流程初步完成转bpmn设计(还有bug,以后再修改)

更多ruoyi-nbcio功能请看演示系统 gitee源代码地址 前后端代码&#xff1a; https://gitee.com/nbacheng/ruoyi-nbcio 演示地址&#xff1a;RuoYi-Nbcio后台管理系统 今天初步完成仿钉钉流程转bpmn设计的工作&#xff0c;当然还有不少bug&#xff0c;以后有需要或者网友也帮…

代码随想录算法训练营第38天| 509. 斐波那契数 70. 爬楼梯 746. 使用最小花费爬楼梯

JAVA代码编写 动态规划&#xff08;Dynamic Programming&#xff09; 一个问题可以划分为多个子问题&#xff0c;且子问题之间有关联&#xff0c;就可以使用动态规划。 动态规划问题步骤&#xff1a; 确定dp数组&#xff08;dp table&#xff09;以及下标的含义确定递推公式…

盘点68个Android游戏Game源码安卓爱好者不容错过

盘点68个Android游戏Game源码安卓爱好者不容错过 学习知识费力气&#xff0c;收集整理更不易。 知识付费甚欢喜&#xff0c;为咱码农谋福利。 Game下载链接&#xff1a;https://pan.baidu.com/s/1hWnuttrqTfwDKYvuVMuSwQ?pwd8888 提取码&#xff1a;8888 项目名称 2048…

Linux学习——模拟实现mybash小程序

目录 一&#xff0c;跟正宗的bash见个面 二&#xff0c;实现一个山寨的bash 1.提示符 2.输入命令与回显命令 3.解析命令 4.执行命令 5.执行逻辑 三&#xff0c;全部代码 一&#xff0c;跟正宗的bash见个面 在这篇文章中&#xff0c;我会写一个myshell小程序。这个小程序…

git的相关实用命令

参看文章&#xff1a;https://blog.csdn.net/qq_21688871/article/details/130158888 http://www.mobiletrain.org/about/BBS/159885.html 1、git commit后&#xff0c;但发现文件有误&#xff0c;不想push(提交到本地库&#xff0c;回退到暂存区&#xff09; git reset --sof…

windows ssh时出现Bad local forwarding specification的解决方案

大家好,我是爱编程的喵喵。双985硕士毕业,现担任全栈工程师一职,热衷于将数据思维应用到工作与生活中。从事机器学习以及相关的前后端开发工作。曾在阿里云、科大讯飞、CCF等比赛获得多次Top名次。现为CSDN博客专家、人工智能领域优质创作者。喜欢通过博客创作的方式对所学的…