本次选取泰坦尼克号的数据,利用python进行抽样分布描述及实践。
备注:数据集的原始数据是泰坦尼克号的数据,本次截取了其中的一部分数据进行学习。Age:年龄,指登船者的年龄。Fare:价格,指船票价格。Embark:登船的港口。
1、按照港口分类,使用python求出各类港口数据 年龄、车票价格的统计量(均值、方差、标准差、变异系数等)。
import pandas as pd df = pd.read_excel('/Users/Downloads/data.xlsx',usecols = [1,2,3] ) #拿到港口'Embarked'、年龄'Age'、价格'Fare'的数据 df2 = df.groupby(['Embarked']) #按照港口'Embarked'分类后,查看 年龄、车票价格的统计量。 # 变异系数 = 标准差/平均值 def cv(data): return data.std()/data.var() df2 = df.groupby(['Embarked']).agg(['count','min','max','median','mean','var','std',cv]) df2 = df2.apply(lambda x:round(x,2)) df2_age = df2['Age'] df2_fare = df2['Fare']
另外有需要云服务器可以了解下创新互联scvps.cn,海内外云服务器15元起步,三天无理由+7*72小时售后在线,公司持有idc许可证,提供“云服务器、裸金属服务器、高防服务器、香港服务器、美国服务器、虚拟主机、免备案服务器”等云主机租用服务以及企业上云的综合解决方案,具有“安全稳定、简单易用、服务可用性高、性价比高”等特点与优势,专为企业上云打造定制,能够满足用户丰富、多元化的应用场景需求。
网页名称:基于python进行抽样分布描述及实践详解-创新互联
转载源于:https://www.cdcxhl.com/article34/dsepse.html
成都网站建设公司_创新互联,为您提供App开发、企业网站制作、软件开发、微信小程序、外贸网站建设、建站公司
声明:本网站发布的内容(图片、视频和文字)以用户投稿、用户转载内容为主,如果涉及侵权请尽快告知,我们将会在第一时间删除。文章观点不代表本网站立场,如需处理请联系客服。电话:028-86922220;邮箱:631063699@qq.com。内容未经允许不得转载,或转载时需注明来源: 创新互联