首页 技术 正文
技术 2022年11月10日
0 收藏 706 点赞 4,987 浏览 1119 个字

一、数据获取

1.本地数据

with 语句,pd.read_csv(‘data.csv’)

2.网站上数据

2.1 直接获取网页源码,在用正则表达式进行删选

2.2 API接口获取—以豆瓣为例

import requests

r=requests.get(https://api.douban.com/v2/book/1084336)

其他电影或者音乐可以直接网上搜索豆瓣API,会有相应教程教你如何使用,切记要直接看官网的

3.NLTK 语料库(自然语言工具包)

需要首先pip install NLTK

nltk.downlod()      然后就会弹出下载框,自己选择要下载的资料

from nltk.corpus import  gutenberg(brown)     资料下载在本地的,需要导入进来

包括古藤保语料库,布朗语料库,路透社语料库,这些都可以在查看其官网上看

二、数据准备

2.1 修改列索引和行索引

data.index=range(1,len(data)+1)

cols=[‘code’,‘name’,’lasttrade’]

2.2 创建时间序列

import pandas as pd

dates=pd.date_range(‘20170520’,periods=7)  创建了7个连续时间序列

建立一个dataFrame时间二维表

data=pd.DataFrame(np.random.randn(7,3),index=dates,colums=list(‘ABC’))

三、数据显示

3.1 一维数据

data.head(5)  查看前5个;data.tail(5)  查看后5个;data.shape   维度;data.size 个数;

3.2 二维数据

loc类和iloc类,前者可以用标签,后者只能用物理位置的参数

data.loc[1:5,[‘code’,’lasttrade’]]

data.loc[1:6,[0,2]]

data.iat[1,’code’] 选择一个之可以有iat也可以用loc类

/// data.iloc[1:5,[0,2]]  中括号里面只能是数字

四、分组Grouping

data.groupby(‘month’).count()

五、合并(append、concat、join)

p.append(q)

concat是连接两个碎片,pd.concat([pieces1,pieces2],igonre_index=True)

join两张表合并,必须要有相同的字段

pd.merge(data.drop([‘code’],axis=1),data2,on=’code’) 给予code将data1和data2两张表合并,并且将data1中code列删除

相关推荐
python开发_常用的python模块及安装方法
adodb:我们领导推荐的数据库连接组件bsddb3:BerkeleyDB的连接组件Cheetah-1.0:我比较喜欢这个版本的cheeta…
日期:2022-11-24 点赞:878 阅读:9,085
Educational Codeforces Round 11 C. Hard Process 二分
C. Hard Process题目连接:http://www.codeforces.com/contest/660/problem/CDes…
日期:2022-11-24 点赞:807 阅读:5,560
下载Ubuntn 17.04 内核源代码
zengkefu@server1:/usr/src$ uname -aLinux server1 4.10.0-19-generic #21…
日期:2022-11-24 点赞:569 阅读:6,409
可用Active Desktop Calendar V7.86 注册码序列号
可用Active Desktop Calendar V7.86 注册码序列号Name: www.greendown.cn Code: &nb…
日期:2022-11-24 点赞:733 阅读:6,182
Android调用系统相机、自定义相机、处理大图片
Android调用系统相机和自定义相机实例本博文主要是介绍了android上使用相机进行拍照并显示的两种方式,并且由于涉及到要把拍到的照片显…
日期:2022-11-24 点赞:512 阅读:7,819
Struts的使用
一、Struts2的获取  Struts的官方网站为:http://struts.apache.org/  下载完Struts2的jar包,…
日期:2022-11-24 点赞:671 阅读:4,902