中企动力 > 商学院 > 数据分析回归excel
  • ?

    大数据时代,你会用Excel吗?

    羊曼荷

    展开

    随着“大数据”概念的持续“高温”,越来越多企业及个人也开始关注数据分析。

    数据分析是什么?

    用一句话概括,就是数据与人类认知的桥梁。

    就像观察微生物需要显微镜、了解时间需要钟表、知道温度需要温度计一样,在理解人类感官无法直接认知的数据问题时就需要使用名为“数据分析”的工具了。

    人类通过“数据分析”,将我们无法认知的数据信息转换为我们可以理解的知识及智慧,企业管理者依据获得的知识及智慧做出正确决策,带领企业走向成功。

    数据分析能干吗呢?

    数据分析主要帮助决策者了解情况、发现规律以及预测将来。

    假如我是一家卖服装的淘宝店长,我需要知道一天内我卖了多少件商品、挣了多少钱、哪个品牌卖的多哪个品牌卖的少、哪种商品需要补货、哪种颜色受欢迎等等信息,以便及时做出策略调整,保持市场竞争优势。

    这就是了解情况。

    在经营了一段时间之后,店里积累了一些历史数据,通过对数据的深入挖掘,我发现特定人群甲喜欢购买圆领深色服装,而另一些特定人群乙喜欢购买宽松浅色服装。

    于是我将圆领深色服装推销给甲,将宽松浅色服装推销给乙,这就是发现规律。

    又经营一段时间后,我发现E品牌商品总是在被浏览2到3次之后就会被卖出去一件,于是我发现浏览次数与销售件数之间存在较强的关联关系,于是我想办法增加E品牌商品的点击次数,通过浏览量的趋势大致可以预测出未来一段时间内销量的变化情况。

    这就是预测将来。

    在工具上除了需要掌握做数据分析工作最离不开的Excel及SQL外,还要掌握一些专业的数据挖掘工具。

    常使用的数据挖掘工具有Python语言、R语言、SPSS、SAS等。想成为合格的数据挖掘向的数据分析师需要一段较长的学习时间以及一定的工作积累。

    业务数据分析方法的目的是对业务情况的事实描述,较少涉及数理统计的相关知识,对业务知识、数据加工处理整合方法、数据汇总方法及业务图表呈现方法的要求较高。基本不要求编程技能。

    此类方法适合非数据分析专业人员学习掌握,比如像从事财务、人力资源、销售支持等业务部门工作的员工,他们已经具备相当丰富的业务知识了,再掌握数据加工、数据汇总及业务图表呈现等技能后便可以独立进行业务数据分析了。

    业务人员进行业务数据分析需要掌握的基本工具主要有两个,一个是Excel,另一个是SQL。

    如果你还能掌握一定的Excel Power BI技能,那么你将有可能为企业决策者提供一份高实用性的多维自助数据可视化分析成果,让决策者想知道什么信息便能快速获得什么信息。

  • ?

    零一数据 [21天小白学成大师]第五天 学会用EXCEL做预测

    以松

    展开

    原创:有点瘦的胖子零一

    需要预测的场景太多这里就不一一赘述了,在师傅的指导下,我对excel的认知水平又提升了一大截,学会了用excel做多元回归分析。这个预测方法不仅适用绝大部分行业,并且也适用没有业务基础的小白操作。附上师父的一句教诲:相信相信的力量。下面进入主题:

    1.打开一张多字段数据的excel表格

    导盲犬:excel中每一列就是一个字段,其第一个单元格内容就是字段名。

    →剪切20%的数据做为测试集,剩余的80%数据做为训练集。→将需要预测的列剪切并复制在其它变量的前面,也就是第2列,这里我们对“无线端下单金额“进行预测,确定影响它的相关因子。

    导盲犬:将需要预测的数据放在首列是为了保持预测时的连续性,另外相关因子的数量最多为16个。

    →数据→数据分析

    →Y值所在区域:预测值所在列的第一行开始至最后一行;X值所在区域:其余变量所在列的第一行开始至最后一行→勾选标志→勾选残差→确定

    导盲犬:残差=实际y值-预测y值,利用条件格式筛选掉残差>两个标准误差的异常值。

    →选中所有残差→开始→条件格式

    →突出显示单元格规则→大于

    →输入2倍标准误差值→确定

    →找出异常值所在行

    →返回数据源将异常值所在行删除即第10行和第39行(注:原数据因为有标题,所以残差异常值所在第9行相当于源数据第10行,又因为第一次删除后导致后面的行数均会上移一行,所以残差异常值所在第39行相当于源数据39行)

    →数据→数据分析

    →回归→确定

    →Y值所在区域:预测值所在列的第一行开始至最后一行;X值所在区域:其余变量所在列的第一行开始至最后一行→勾选标志→勾选残差→确定

    →筛选出<0.05的P值

    导盲犬:统计学家普遍的共识,p<0.05的时候,自变量对预测y才有用.

    →开始→条件格式

    →突出显示单元格规则→小于→0.05→确定

    为了预测更加准确,这里还需考虑多重共线性,利用半相关矩阵检查。

    导盲犬:如果说两个或多个自变量是高度相关的,很可能产生多重共线性。

    →返回数据源→数据→数据分析→相关系数→确定

    →输入区域(除预测值外的所有数据)→标志位于第一行→确定

    →开始→条件格式→突出显示单元格规则

    →大于→0.998→确定

    →删除字段下单父订单数、无线端支付父订单数。

    导盲犬:所谓多重共线性(Multicollinearity)是指线性回归模型中的解释变量之间由于存在精确相关关系或高度相关关系而使模型估计失真或难以估计准确。

    →源数据→数据→数据分析→回归→确定

    →观察R方与P值

    导盲犬:所有自变量共同作用具有显著性的结论,通俗的讲,只有R方大于0.6的时候,预测y才有意义。

    →选中所有变量的P值→开始→条件格式→突出显示单元格规则→小于

    →0.05→确定→删除其它P值>0.5的变量

    →源数据→数据→数据分析→回归→确定

    →Y值所在区域:预测值所在列的第一行开始至最后一行;X值所在区域:其余变量所在列的第一行开始至最后一行→勾选标志→确定

    →观察R值和P值,均符合要求。

    →得出公示:预测值无线端下单金额=-84341.91323+无线端下单买家数*365.259139-392.2248391*无线端支付买家数+1.200575347*无线端支付金额

    导盲犬:Intercept为截距的意思。

    →返回测试集验证

    通过验证发现预测的点跟测试集的点高度吻合,该模型可以使用。

    预测是商业分析的核心,企业之所以能产生利润主要就是因为企业获得了信息差,而预测就是帮助企业创造信息差。因此,预测能力是最能体现数据分析师价值的点。

  • ?

    Excel中如何对所得数据进行显著性检验

    沛芹

    展开

    excel进行显著性检验的方法与步骤:
    1.先找ADD-IN,添加数据分析工具data analysis tool。 Add-in的选项在File-> Option->Add Ins, 选择analysis tool pack。

    2.会跳出来一个窗口,再选中analysis tookpack ,确定就好了。
    3.把得到的两组数据输入EXCEL里。
    4.在DATA里面,选择data analysis,跳出来新窗口,选中correlation(相关性)。然后按照提示,选中要分析的数据。

    5.EXCEL会自动运行回归分析,给出分析报告。分析报告里mutiple R 接近1,就说明两个的相关性比较大。拟合关系要看R2,显著性看signifnance F。

    (本文内容由百度知道网友茗童贡献)

  • ?

    数据分析培训学习,怎么用Excel做数据分析

    单道罡

    展开

    今天科多大数据小课堂来教大家用Excel怎么做数据分析。

    现如今,各行各业的求职都需要简历包装。尤其是文职类简历,想要赢得offer,你不得在精通Excel等办公软件上下点功夫么?那么,你真的了解Excel嘛?或者,你知道用它怎么做数据分析嘛?

    所谓数据分析在手,走遍天下都不怕。而 Excel 作为最简单的办公软件,功能却不容小觑,同样可以实现分类、聚类、关联和预测来进行数据分析。这些概念听起来比较抽象,其实一点都不难,今日文章直接来一波干货,从具体操作开始讲起。

    01 掌握基本 Excel 快捷键

    工欲善其事,必先利其器,自从笔者发现了excel快捷键,就打开了新世界的大门。 虽然都是很基础的操作,一旦运用熟练将会大幅提升效率。

    最好用的复制命令: Ctrl + R 向右复制 Ctrl + D 向下复制

    选择格式粘贴:Ctrl + Alt + V

    求和功能:Alt + = 然后按回车键

    格式调整:Ctrl + Shift + 7 加上外边框 Ctrl + Shift + - 去掉边框 Ctrl + Shift + 5 改成%数值格式

    视图调整及编辑: Ctrl + Shift + = 插入行 Ctrl + - 删除

    终极:开始工具栏所有的命令都可以通过 Alt - H - 调用

    Alt: 激活选项,配合选项英文字母使用

    Shift:连续选择,配合方向键,翻页键等使用; 上位键

    Ctrl:配合其他键可以执行一项命令 如Ctrl + C 复制;快速移动光标,配合方向键使用,如向右快速移动光标 (Ctrl + →)

    02 数据收集

    在数据分析之前,首先需要找到可靠的数据源。国内的公司数据可以在 wind 上下载,宏观数据可以在国家统计局上找到,而国外比较常用的网站有 SEC,WRDS (Wharton Research Data Services)。

    需要注意的是,原始数据一般保留不做处理,通过 Excel 或其他编程软件做后续处理。

    03 数据清洗与筛选等基础操作

    杂乱无章的原始数据是难以分辨的,因此需要对海量数据进行清洗和筛选才能找出其中的规律。

    常见的方法有如下几种:

    运用描述性统计命令观察数据的离散程度等基本情况:通过添加“分析工具库”加载项找到数据-数据分析-描述统计,可以得到这组数据的中位数、众数、峰度、偏度等基本指标,观察这组数据的特征。此外,数据分析中还有方差分析等其他命令。

    运用 VLOOKUP 将数据合理分组,收放自如:VLOOKUP 函数是 Excel 中的一个纵向查找函数,可以用来核对数据,多个表格之间快速导入数据等函数功能。功能是按列查找,最终返回该列所需查询列序所对应的值。比如,我们导出公司的原始报表后,可以通过 VLOOKUP 函数将报表中的数字一一导入到新的管理用的财务报表,这样既不会破坏原始数据,又可以建立良好的模板,方便后续使用。VLOOKUP 的四个参数用通俗的话来说,就是(要找谁,要在哪里找,要找哪一列内容,是精确的还是模糊的)

    运用数据透视表分组求平均数、标准差、计数等多个指标:数据透视表是一个非常容易上手的分组工具,对于简单的数据处理甚至在便捷程度上打败了很多编程工具呢。比如要对每个省份的所有专业分数线求一个平均数,将年份和省份轻松地拖动到对应的列和行,就可以得到结果啦。试想,如果在原始表格中手动一个一个求平均数该有多麻烦。

    运用条件函数计算融资缺口,检查配平:比如在预测财务报表时,我们常常要判断资产是否等于负债+所有者权益。此时可以用 IF 函数 (资产=负债+所有者权益,TRUE,FALSE)如果是配平的,直接返回 TRUE。此外,还有一些函数如 IRR 可以计算项目的投资回报率。

    04 挖掘数据背后的规律

    在完成了数据清洗和筛选之后,我们还是要落实到数据分析的重点,也就是数据背后的逻辑。

    首先我们可以采用画图的方式。画图可以非常直观地佐证结论,不同情况下要用不同类型的图,比如饼图显示比重,折线图发现趋势,还可以采用叠加多种形式的图。

    下面这张图就是一个数据分析应用的经典例子,显示的是一个教育公司在扩张过程中,学习中心同比增速与营业毛利率的关系。试想,如果只是一堆数据放在你的面前,可能根本无法发现其中的规律,但是通过下图,我们可以发现,学习中心的同比增速一般与营业毛利率呈反向关系,这也就意味着,扩张的过程必然要伴随利润下降的阵痛,这样的数据分析就是有效的,可以为公司的扩张战略提供参考依据。

    另一种比较常见的数据分析应用就是从历史预测未来。比如如果公司过去几年的存货周转率都比较稳定,可以以此来预测未来几年的存货周转率。又或者通过线性回归发现某两个指标之间过去的线性关系,并以此来预测未来走势,这个操作方法可以用散点图——添加趋势线——选择回归类型(线性)来得出简单的结论。

    说了这么多,列举 Excel 数据分析的一个常见运用。

    大家知道,金融领域的工作往往要考察搭建财务模型的技巧,而这个模型就是完完全全从 0 开始通过 Excel 制作的。

    1. 计算各项指标了解公司的历史经营状态。这一步不仅可以看出公司在盈利能力、成长性、营运能力等多个维度的历史发展状况,还可以与同行业的可比公司进行比较,看出这个公司所处的地位(比如公司的应收账款周转率可以直观看出公司是强势地位还是弱势地位,应收账款周转率如果显著低于同业,那就说明应收账款很容易收到,议价能力强)。

    2. 预测公司未来的盈利状况,并通过财务报表的勾稽关系完善财务模型。这一步一定要打开 Excel 的自动迭代功能(选项——公式——启用迭代计算),具体的财务方面知识在此就不再详述。

    3. 现金流 DCF 模型及敏感性分析。以之前制作的财务报表为基础,就可以测算出公司未来的自由现金流,在计算出公司资本成本的前提下对现金流进行贴现得到公司绝对估值。其中,基于不同的资本成本和公司永续增长率还可以做成敏感性分析的表格,得出在不同情形下公司的估值。这就需要使用Excel的数据——模拟运算——模拟运算表功能了。如下图所示,将输入引用行的单元格和引用列的单元格分别设为 Equity Valuation 中的永续增长率和Wacc对应的数值,就可以实现啦。

    以上这些介绍都只是冰山一角,Excel的功能博大精深,加上VBA等高端操作将会释放更大的威力。配合现当代大数据盛行时期。想要深入,就还得不断学习!

  • ?

    未来公务员都会是数据分析高手了,你还只会Excel吗?

    薛煜祺

    展开

    据外媒报道,新加坡2万公务员将在未来5年内接受数据分析培训,新加坡政府已任命首席数据战略官员,领导实现政府各部门的数据化计划。大数据时代,公务员们都得是“数据”高手!数据分析在新加坡已经是最热门的职业,也是应届生们的首选职业之一。

    大数据风潮席卷全球,为什么人人都要学数据分析?

    1.为什么要学数据分析

    大数据号称新时代的石油,很多行业都开始用数据驱动业务,通过对数据的分析和挖掘,从单纯的数据报表,到建模分析,深入挖掘,来帮助业务部分来系统的思考问题。

    同时,数据分析也相对容易一些,比较好上手。

    Python的应用的领域可以分为爬虫、web开发、数据分析、机器学习等方向。和机器学习相比,数据分析偏业务,机器学习偏工程,数据分析入门对数学功底和算法基础的要求并不是特别高。

    2.为什么选Python做数据分析

    可以来做数据分析的语言和工具比较多,为什么偏偏选Python?

    拿常见的R语言和Excel来说:

    R语言其实是为统计学而生的语言,用来做统计学确实非常厉害。

    但是R语言在语法的美观和使用的简洁便利上看,要比Python差很多,小函数一堆,而且语法不好理解,没有Python这么容易上手和通熟易懂。

    而 Excel只能做一些简单的处理逻辑处理,适合小规模的数据集,或者简单的数据清洗,对于复杂的逻辑处理,数据清洗,还是用Python来的方便。

    3.数据分析岗位职业发展路径

    在数据科学领域,有三个不同的角色,分别是:商业分析师,数据工程师和数据科学家,难度依次递增。

    1.商业分析师

    商业分析师的工作主要围绕报表和指标这两块儿,包括:

    1).定义关键绩效指标

    2).设计和实现报表

    3).从用户那里收集报表需求

    4).与数据工程师对接确保数据被正确地收集和存储

    5).查询数据(一般是聚合过的)

    2.数据工程师

    数据工程师的工作主要围绕架构和收集这两块儿,包括:

    1).通过写数据传输包、设计聚合过程、优化存储,来构建和维护数据传输和存储的基础设施

    2).将生产环境产生的原始数据,转换为商业分析师可以用来制作报表的格式化的数据

    3.数据科学家

    数据科学家的工作主要围绕预测和优化这两块儿,包括:

    1).负责构建预测算法,以提升用户体验,最终增加参与度、留存率、收益

    2).负责数据驱动的产品的改进和建议

    这其实是一个金字塔,商业分析师位于金字塔的最底层,数据科学家位于金字塔的最顶层。

    4.数据分析师的薪资如何

    拉勾网上数据分析师基本上在1-2年经验的平均年薪在20万左右。

    再看一下数据分析师的岗位主要需求城市:

    主要是在北上广深和杭州 5个大的城市,其中北京的需求最多,几乎是第2/3/4位的总和。

    5.数据分析需求技能

    数据分析的内容多,而且比较全面,比如我们前面写了很多关于房地产,拉勾照片,旅游网站的数据,一般来说数据分析分下面几个过程:

    第一步:数据的爬取

    数据分析过程非常像我们平时做饭,第一步要先买菜,如何获取数据呢,很多时候我们需要爬取数据,爬虫涉及的知识比较多:

    比如常见的http原理,爬虫的基本解析库reuqests,网页解析库BS,Pyquery,掌握一些分布式爬虫的框架,当然还有一些反爬虫的策略。当然如果我们能有现成的数据集会方便很多。

    第二步:数据格式的处理和清洗

    买好了菜,接着我们需要洗菜,也就是数据清洗!常见的数据集都是csv和json格式,需要熟练的掌握着两种格式的。Python中数据分析的神兵利器是Pandas,这个库非常好用,功能也是非常强大的。可以对数据进行各种花色的清洗和切割,几乎所有用Python玩数据分析,必须学会pandas库的用法。

    第三步:数据的存储

    清洗完成之后数据需要存储起来,一般用的比较多的 SQL 和 MongoDB。几乎所有的数据分析师招聘都会面试SQL的用法,所以掌握一门数据的使用是非常有必要的!基本的增删改查这样入门级的操作,一定要熟练掌握。

    第四步:数据的探索

    我拿到一个数据集之后,需要对数据进行探索,分析数据之间的关系,每个特征值,每个变量的之间相关性和相互的影响,比如常见的EDA 探索数据分析法。

    单变量,双变量和多变量的探索,可以从很多角度,对数据进行切片分析,非常数据集中的变量之间的关系,找出相关性比较强的数据。

    如果需要对数据进行深入的挖掘,需要了解机器学习的相关算法,大体分监督学习和无监督学习,比如回归问题,分类问题。这部分对数据集进行深入挖掘之后,可以找出数据间的规律,训练好的之后,可以预测数据,很是牛逼。

    第五步:数据的可视化

    展现数据最好的方法就是数据可视化,数据的可视化有很大的库,比如 echart,matplotlib,d3 和 Tableau,当然还有excel,一般数据分析师必须要掌握exce或者Tableau。尤其是Tableau现在越来越多的公司用它来做可视化分析,有一个有趣的必然,同样一个库用R语言需要30分钟才能完成,Tableau只需要5分钟。

    现在科多大数据更新大数据开发、数据分析、python爬虫等试听视频,小伙伴们可上科多大数据官网咨询领取哦~

  • ?

    使用EXCEL回归工具做全国乘用车销量预测

    祁雪柳

    展开

    前面对时间序列的预测方法做了简单的介绍,

    其中反复提到的数据分析工具--回归

    回归分析(regression analysis)是确定两种或两种以上变量间相互依赖的定量关系的一种统计分析方法。

    今天就通过一组数据,来演示一下回归工具的使用方法:

    第一种:线性回归

    时间做为自变量,销量为因变量

    按步骤选择好,按确定,会自动输出结果:

    这个结果,大家可以研究一下,统计学的相关指标里面都有

    我们关注两点:

    R Square:的值越大,这个这条回归线越贴合实际值

    Intercept:回归线与Y轴的交点

    X Variable 1:系数

    方程式就是这样的:Y=Intercept+X Variable 1*TIME

    第二种:非线性回归

    我们学过的一元多次方程

    把时间变量,平方、立方列出来,做自变量

    我们得到的结果就多了几个系数:

    第三种:多元回归

    时间、汽车产量作为自变量

    第四种:自回归

    把汽车销量滞后一期作为自变量

    最后我们来看看成果

    多元回归的R Square值是最大的,多元回归的曲线与实际销量曲线最为贴合

    也说明,汽车产量与销量高度相关。

    说在最后:今年汽车销售市场应该说不景气,到了增长的拐点。

    数据分析只是根据历史数据做的一个判断

    然而,市场环境恶化,经济下行等宏观因素,对未来的汽车销售的影响巨大

    在有宏观环境因素变化时,就要谨慎使用历史数据

    在平稳运行时,依靠数据预测更为准确。

  • ?

    数据分析Excel、SAS、R、SPSS、Python这5大软件优势

    巴拉奥纳

    展开

    工欲善其事,必先利其器。说起来道理大家都懂,只是到了要学习的时候就开始各种退缩。殊不知一款好的数据分析工具可以让你事半功倍,瞬间提高学习工作效率。

    虽然数据分析的工具千万种,综合起来万变不离其宗。无非是数据获取、数据存储、数据管理、数据计算、数据分析、数据展示等几个方面。而SAS、R、SPSS、python、excel是被提到频率最高的数据分析工具。那么,这些工具本身到底有什么特点呢?

    Excel

    Excel 是微软办公套装软件的一个重要的组成部分,它可以进行各种数据的处理、统计分析和辅助决策操作,广泛地应用于管理、统计财经、金融等众多领域。

    1、数据透视功能

    一个数据透视表演变出10几种报表,只需吹灰之力。一个新手,只要认真使用向导1-2小时就可以马马虎虎上路。

    2、统计分析

    其实包含在数据透视功能之中,但是非常独特,常用的检验方式一键搞定。

    3、图表功能

    这几乎是Excel的独门武工,其他程序望其项背而自杀。

    4、高级筛选

    这是Excel提供的高级查询功能,而操作之简单。非常超值享受。

    5、自动汇总功能

    这个功能其他程序都有,但是Excel简便灵活。

    6、高级数学计算

    只要一两个函数轻松搞定

    SAS软件

    SAS是全球最大的软件公司之一,是由美国NORTH CAROLINA州立大学1966年开发的统计分析软件。SAS把数据存取、管理、分析和展现有机地融为一体。

    主要优点如下:

    1、功能强大,统计方法齐,全,新

    SAS提供了从基本统计数的计算到各种试验设计的方差分析,相关回归分析以及多变数分析的多种统计分析过程,几乎囊括了所有最新分析方法,其分析技术先进,可靠。分析方法的实现通过过程调用完成。许多过程同时提供了多种算法和选项。

    2、使用简便,操作灵活

    SAS以一个通用的数据(DATA)步产生数据集,尔后以不同的过程调用完成各种数据分析。

    其编程语句简洁,短小,通常只需很小的几句语句即可完成一些复杂的运算,得到满意的结果。结果输出以简明的英文给出提示,统计术语规范易懂,具有初步英语和统计基础即可。使用者只要告诉SAS“做什么”,而不必告诉其“怎么做”。

    同时SAS的设计,使得任何SAS能够“猜”出的东西用户都不必告诉它(即无需设定),并且能自动修正一些小的错误(例如将DATA语句的DATA拼写成DATE,SAS将假设为DATA继续运行,仅在LOG中给出注释说明)。对运行时的错误它尽可能地给出错误原因及改正方法。因而SAS将统计的科学,严谨和准确与便于使用者有机地结合起来,极大地方便了使用者。

    3、提供联机帮助功能

    使用过程中按下功能键F1,可随时获得帮助信息,得到简明的操作指导。

    R软件

    R是一套完整的数据处理、计算和制图软件系统。

    主要优点如下:

    数据存储和处理系统数组运算工具(其向量、矩阵运算方面功能尤其强大)完整连贯的统计分析工具优秀的统计制图功能简便而强大的编程语言:可操纵数据的输入和输出,可实现分支、循环,用户可自定义功能

    与其说R是一种统计软件,还不如说R是一种数学计算的环境,因为R并不是仅仅提供若干统计程序、使用者只需指定数据库和若干参数便可进行一个统计分析。

    R的思想是:它可以提供一些集成的统计工具,但更大量的是它提供各种数学计算、统计计算的函数,从而使使用者能灵活机动的进行数据分析,甚至创造出符合需要的新的统计计算方法。

    该语言的语法表面上类似 C,但在语义上是函数设计语言的(functional programming language)的变种并且和Lisp 以及APL有很强的兼容性。特别的是,它允许在“语言上计算”(computing on the language)。这使得它可以把表达式作为函数的输入参数,而这种做法对统计模拟和绘图非常有用。

    R是一个免费的自由软件,它有UNIX、LINUX、MacOS和WINDOWS版本,都是可以免费下载和使用的。在R主页那儿可以下载到R的安装程序、各种外挂程序和文档。在R的安装程序中只包含了8个基础模块,其他外在模块可以通过CRAN获得。

    SPSS

    SPSS是世界上最早的统计分析软件。

    主要优点如下:

    操作简便:界面非常友好,除了数据录入及部分命令程序等少数输入工作需要键盘键入外,大多数操作可通过鼠标拖曳、点击“菜单”、“按钮”和“对话框”来完成。

    编程方便:具有第四代语言的特点,告诉系统要做什么,无需告诉怎样做。只要了解统计分析的原理,无需通晓统计方法的各种算法,即可得到需要的统计分析结果。对于常见的统计方法,SPSS的命令语句、子命令及选择项的选择绝大部分由“对话框”的操作完成。因此,用户无需花大量时间记忆大量的命令、过程、选择项。

    功能强大:具有完整的数据输入、编辑、统计分析、报表、图形制作等功能。自带11种类型136个函数。SPSS提供了从简单的统计描述到复杂的多因素统计分析方法,比如数据的探索性分析、统计描述、列联表分析、二维相关、秩相关、偏相关、方差分析、非参数检验、多元回归、生存分析、协方差分析、判别分析、因子分析、聚类分析、非线性回归、Logistic回归等。

    数据接口:能够读取及输出多种格式的文件。比如由dBASE、FoxBASE、FoxPRO产生的*.dbf文件,文本编辑器软件生成的ASCⅡ数据文件,Excel的*.xls文件等均可转换成可供分析的SPSS数据文件。能够把SPSS的图形转换为7种图形文件。结果可保存为*.txt及html格式的文件。

    模块组合:SPSS for Windows软件分为若干功能模块。用户可以根据自己的分析需要和计算机的实际配置情况灵活选择。

    针对性强:SPSS针对初学者、熟练者及精通者都比较适用。并且很多群体只需要掌握简单的操作分析,大多青睐于SPSS。

    Python

    Python是一种面向对象、解释型计算机程序设计语言。Python语法简洁而清晰,具有丰富和强大的类库。它常被昵称为胶水语言,能够把用其他语言制作的各种模块(尤其是C/C++)很轻松地联结在一起。

    常见的一种应用情形是,使用Python快速生成程序的原型(有时甚至是程序的最终界面),然后对其中有特别要求的部分,用更合适的语言改写,比如3D游戏中的图形渲染模块,性能要求特别高,就可以用C/C++重写,而后封装为Python可以调用的扩展类库。需要注意的是在您使用扩展类库时可能需要考虑平台问题,某些可能不提供跨平台的实现。

    主要优点如下:

    简单:Python是一种代表简单主义思想的语言。阅读一个良好的Python程序就感觉像是在读英语一样。它使你能够专注于解决问题而不是去搞明白语言本身。

    易学:Python极其容易上手,因为Python有极其简单的说明文档 。

    速度快:Python 的底层是用 C 语言写的,很多标准库和第三方库也都是用 C 写的,运行速度非常快。

    免费、开源:Python是FLOSS(自由/开放源码软件)之一。使用者可以自由地发布这个软件的拷贝、阅读它的源代码、对它做改动、把它的一部分用于新的自由软件中。FLOSS是基于一个团体分享知识的概念。

    高层语言:用Python语言编写程序的时候无需考虑诸如如何管理你的程序使用的内存一类的底层细节。

    可移植性:由于它的开源本质,Python已经被移植在许多平台上(经过改动使它能够工作在不同平台上)。

    解释性:一个用编译性语言比如C或C++写的程序可以从源文件(即C或C++语言)转换到一个你的计算机使用的语言(二进制代码,即0和1)。这个过程通过编译器和不同的标记、选项完成。运行程序的时候,连接/转载器软件把你的程序从硬盘复制到内存中并且运行。而Python语言写的程序不需要编译成二进制代码。你可以直接从源代码运行程序。

    在计算机内部,Python解释器把源代码转换成称为字节码的中间形式,然后再把它翻译成计算机使用的机器语言并运行。这使得使用Python更加简单。也使得Python程序更加易于移植。

    面向对象:Python既支持面向过程的编程也支持面向对象的编程。在“面向过程”的语言中,程序是由过程或仅仅是可重用代码的函数构建起来的。在“面向对象”的语言中,程序是由数据和功能组合而成的对象构建起来的。

    可扩展性:如果需要一段关键代码运行得更快或者希望某些算法不公开,可以部分程序用C或C++编写,然后在Python程序中使用它们。

    可嵌入性:可以把Python嵌入C/C++程序,从而向程序用户提供脚本功能。

    丰富的库:Python标准库确实很庞大。它可以帮助处理各种工作,包括正则表达式、文档生成、单元测试、线程、数据库、网页浏览器、CGI、FTP、电子邮件、XML、XML-RPC、HTML、WAV文件、密码系统、GUI(图形用户界面)、Tk和其他与系统有关的操作。这被称作Python的“功能齐全”理念。除了标准库以外,还有许多其他高质量的库,如wxPython、Twisted和Python图像库等等。

    规范的代码:Python采用强制缩进的方式使得代码具有较好可读性。而Python语言写的程序不需要编译成二进制代码。

    工具不是万能的,业务和数据建模方法才是万法之源。不要被工具迷花了眼哦!

  • ?

    她说:掌握这些Excel数据分析,你的工作将会翻天覆地!

    易云

    展开

    又是一年实习季......

    很多优秀的金融小伙伴已经陆陆续续进入了各大券商实习,希望施展拳脚,争取留用机会。

    最近接到几位朋友的倾诉:

    “工作后发现,很多之前听过基础的办公软件,偷懒没学,没想到工作中经常需要用到,然而自己却用的不溜,有些甚至一点不会......”“像数据分析工具,基本从事券商行业都得用,可是老员工一般都比较忙,根本没时间教,只能自己毫无效率的一点一点摸索,唉......”“一起进去实习的有一位,因为提前学习了相关的技能,既会excel数据分析,又会用VBA编程,各种自动化操作,领导一直夸赞,感觉自己留用无望了......”

    听完之后,小编迅速打开招聘网站,果然...... 大部分券商投行等岗位招聘要求是这样的:

    毫无疑问,快速搜集、处理大量金融数据并形成客户和老板想要的结果,是每一个金融从业者都必须具备的核心技能。数据的收集处理能力和财务分析能力一样,构成了金融大咖们的两大核心竞争力。

    因此,对于游走在业绩分析会与路演会间隙做相关数据报告的资深金融人来说,会数据分析尤为重要。

    除此之外

    金融人的工作里头还有大量的Excel表格需要处理,而且需要做的非常高端上档次。因为这样,领导拿出去用,才倍儿有面儿!

    像这样......

    这样......

    因此,花极少的时间,就掌握一门高大上的数据可视化技能,非Excel数据分析不可!这也是金融人士应该掌握的技能。

    还没结束......

    仅简单的Excel技能还不足以满足金融人士的处理需求,在很多条件下,高阶函数和Excel VBA才是制胜王道。如何使用Excel胜任批量操作、处理复杂函数甚至自定义Excel选项卡,是投行大咖的基本标配,也是金融人士的进阶技能——Excel VBA。

    Excel VBA批处理起来,效率那叫一个快!主要用于处理Wind终端导出来的数据,学起来比较简单,属于金融从业者性价比最高的技能之一。

    还可以自动制做可视化图表,批量整理各种数据......

    回归线Excel,致力于为客户提供基于Excel的解决方案。帮助客户提高Excel应用水平,扩展Excel应用能力,改进工作效率,对数据收集,数据清洗,数据分析,数据展现等都有非常直接的经验和方法。

  • ?

    用Excel进行数据分析的正确指南

    Raahe

    展开

    最近几天,不断有小伙伴在后台问到使用excel做数据分析的相关问题,今天,数据君(ID:shendufenxi)就为大家推送一篇实用技巧。

    高级的数据分析会涉及回归分析、方差分析和T检验等方法,不要看这些内容貌似跟日常工作毫无关系,其实往高处走,MBA的课程也是包含这些内容的,所以早学晚学都得学,干脆就提前了解吧,请查看以下内容。

    在使用之前,首先得安装Excel的数据分析功能,默认情况下,Excel是没有安装这个扩展功能的,安装如下所示:

    1)鼠标悬浮在Office按钮上,然后点击【Excel选项】:

    2)找到【加载项】,在管理板块选择【Excel加载项】,然后点击【转到】:

    3)选择【分析工具库】,点击【确定】:

    4)安装完后,就可以【数据】板块看到【数据分析】功能,如下所示:

    安装完后,首先来了解一下回归分析的内容。

    回归分析

    在详细进行回归分析之前,首先要理解什么叫回归?

    实际上,回归这种现象最早由英国生物统计学家高尔顿在研究父母亲和子女的遗传特性时所发现的 一种有趣的现象:身高这种遗传特性表现出”高个子父母,其后代身高也高于平均身高;但不见得比其父母更高,到一定程度后会往平均身高方向发生’回归’”。

    这种效应被称为”趋中回归”。现在的回归分析则多半指源于高尔顿工作的那样一整套建立变量间的数量关系模型的方法和程序。 这里的自变量是父母的身高,因变量是子女的身高。

    百度百科对于回归分析的定义是: 回归分析(regression analysis)是确定两种或两种以上变数间相互依赖的定量关系的一种统计分析方法。运用十分广泛:

    1)回归分析按照涉及的自变量的多少,可分为一元回归分析和多元回归分析;

    2)按照自变量和因变量之间的关系类型,可分为线性回归分析和非线性回归分析。

    这里举个电商的例子:电子商务的转换率是一定的,网站访问数一般正比对应于销售收入,现在要建立不同访问数情况下对应销售的标准曲线,用来预测搞活动时的销售收入,如下所示:

    1、利用散点图描绘图形:

    2. 添加趋势线,并且显示回归分析的公式和R平方值:

    从图得知,R平方值=0.9995,趋势线趋同于一条直线,公式是:y=0.01028x-27.424

    R 平方值是介于 0 和 1 之间的数字,当趋势线的 R 平方值为 1 或者接近 1 时,趋势线最可靠。因为R2 >0.99,所以这是一个线性特征非常明显的数值,说明拟合直线能够以大于99.99%地解释、涵盖了实际数据,具有很好的一般性, 能够起到很好的预测作用。

    3. 使用Excel的数据分析功能

    1)点击【数据分析】,在弹出的选择框中选择【回归】,然后点击【确定】:

    2)【X值输入区域】选择访问数的单元格,【Y值输入区域】选择销售额的单元格,同时勾选如下所示的选项,包括残差、标准残差、残差图、线性拟合图和正态概率图。

    3)以下内容是残差和标准残差:

    4)以下是残差图:

    残差图是有关于实际值与预测值之间差距的图表,如果残差图中的散点在中轴上下两侧分布,那么拟合直线就是合理的,说明预测有时多些,有时少些,总体来说是符合趋势的,但如果都在上侧或者下侧就不行了,这样有倾向性,需要重新处理。

    5)以下是线性拟合图

    在线性拟合图中可以看到,除了实际的数据点,还有经过拟和处理的预测数据点,这些参数在以上的表格中也有显示。

    6)以下是正态概率图

    正态概率图一般用于检查一组数据是否服从正态分布,是实际数值和正态分布数据之间的函数关系散点图,如果这组数值服从正态分布,正态概率图将是一条直线。回归分析不一定得符合正态分布,这里只是仅仅把它描绘出来而已。

    以上数据表格和图表都说明公式y=0.01028x-27.424是一个值得信赖的预测曲线,假设搞活动时流量有50万访问数的话,那么预测销售将是51373,如下图所示:

  • ?

    如何用EXCEL线性回归分析法快速做数据分析预测

    贲碧蓉

    展开

    回归分析法,即二元一次线性回归分析预测法

    先以一个小故事开始本文的介绍。十三多年前,笔者就职于深圳F集团时,曾就做年度库存预测报告,与笔者新入职一台籍高管Edwin分别按不同的方法模拟预测下一个年度公司总存货库存。令我吃惊的是,本人以完整的数据推算做依据,做出的报告结果居然与仅入职数周,数据不齐全的Edwin制定的报告结果吻合度达到99%以上。仍清楚记得,笔者曾用得是标准的周转天数计算公式反推法,而Edwin用的正是本文重点介绍的二元一次线性回归分析法。

    二元一次线性回归分析法是一种数据分析模型。

    在EXCEL函数公式是FORECAST(英文意思是:预测),其用途是根据一条线性回归拟合线返回一个预测值,此函数使用可对未来销售额、库存需求或未来数据趋势进行预测分析。

    要做好库存预测须具备几个条件,首先须具备过去较长的某个时间段的完整整的数据。这里说的时间段最好是上一年度一整年或最近两年的数据。

    完整的数库据指的是需要有年度对应每个月的实际库存与营收额或销货成本。

    同样我们把库存预测肢解成几个关键步骤。

    第一步:数据准备,依要求对EXCEL公式数据输入

    先看一组实际的数据,其中蓝色字体是已知具备的数据,黄色则是需要预测的库存数据。预测库存,则至少需要具备的数据是标注蓝色三行数据。为别是:上一年度月营收,上一年度月实际库存,本年度月营收目标。可参照始下截图与视频。

    二元一次回归分析法实例截图二元一次回归分析公式实例示图

    第二步:依KPI目标调整预测数据

    假设要求实际目标要求对总体存货周转率提升10%,则总体平均存货库存也减少10%,具体数据如下截图标注粉色行。

    依目标进行调整数据截图

    第三步:把总库存分解成不同物料形态的库存。这里讲的不同类别可以指的是:

    物料形态分类:原材料、半成品、在制品以及成品等。

    仓码分类:原材料仓、包装仓、成品仓、重要物资仓、五金仓、配件仓以及辅助物料仓等。

    这里我们以第一种物料类型实例说明。须依据上年度不同物料类别占总库存的比率,再计算对应类别库存总额,如下截图。

    依比率计别算出不同物料库存截图

    第四:验证二无一次线性回归分析方法的准确度。

    存货周转天数=((期初库存+期末库存)/2*30)/(营收*物料成本率)=(平均库存*30)/销售成本。

    依公式反推预测库存,平均库存=(目标周转天数*营收*物料成本率)/30,前提需要更多的数据信息,包括物料成本率与以往的周转天数做为计划依据。

    如下截图,两种不同的方法得出库存预测吻度为97%(或103%)。

    二元一次回归分析法验证截图

    企业管理中,要快速地对企业活动做出判断,需要完整的数据管理积累支撑

    二元一次回归分析法做库存预测速度快,效率更高。而标准的周转天数计算预法会更准确与准确。到底应当选择哪个方法?不同的时期,不同的方法如何选择则是仁者见仁,没有对或错,只有合适与否。但有肯定的一点,那就是类似二元一次回归分析法管理工具的熟练应用,则一定对会对企业管理起到更好的帮助,在做数据调研时也是个好的选择。

数据分析回归excel

所有视频需要登录后,才能观看

请先登录您的帐号,即可完整播放,如果您尚未注册帐号,请先点击注册。

img

在线咨询

建站在线咨询

img

微信咨询

扫一扫添加
动力姐姐微信

img
img

TOP