机器学习-Pandas学习笔记

  1. Pandas Python的数据分析库,与Numpy配合使用,可以从常见的格式如CSV、JSON等中读取数据。可以进行数据清洗、数据加工工作。
  2. 数据结构Series,Pandas.Series(data,index,dtype,name,copy)
    data类型是Numpy的ndarray类型,index指定下标,如果不给默认从0开始,name给series名字
  3. 数据类型DataFrame,Pandas.DataFrame(data,index,columns,dtype,copy)
  4. 利用Pandas读取CSV,以逗号或其他字符分隔,可以用Excel打开
  • Pandas.read_csv("路径"),可以指定显示的行
  • Pandas.info获取读取文件的信息
  1. 利用Pandas读取JSON,\转义,,分隔,{}保存对象,[]保存数组
  • Pandas.read_json("路径")
  • 可以直接将Python的字典以Json格式读入,字典里放字典
  • 如果Json套Json,需要用Pandas.json_normalize(哪个Json,Json里的哪一类需要展平,需要将没展平的哪些列加以展示)进行展平
  1. 数据清洗,是数据预处理的一步
    Pandas文档
  • 不用背API,用到了去查文档
  • DataFrame.duplicated()查看数据是否重复
  1. 打一下老师博文里的内容
    Pandas博客资料

补充一点Pytorch基础

  1. cafe,keras(合并到tensorflow)古老,没人用。tensorflow(Google 工业),pytorch(facebook 学业)

  2. Pytorch的基本数据类型:张量,标量,向量,矩阵是特殊的张量。Pytorch可以在GPU上运行,Numpy不行。
    Pytorch官方文档

  3. Numpy和Pytorch。一个在CPU上运行,一个在GPU上运行,所以要互相转化。
    PyTorch博客资料

  4. 要在Jupyter中使用Pytorch,需要创建带有Pytorch的Conda环境,然后在该core下打开Jupyter创建文件

相关推荐
列星随旋33 分钟前
线段树和树状数组的学习
学习·算法
辰海Coding2 小时前
MiniSpring框架学习-整合 IoC 和 MVC(NPC)
学习·spring·mvc
知识分享小能手3 小时前
Flask入门学习教程,从入门到精通,数据库操作 — 知识点详解与案例代码(4)
数据库·学习·flask
wubba lubba dub dub7504 小时前
第四十八周学习周报
学习
生成论实验室5 小时前
用事件关系网络重新理解AI(三):激活函数、微调与元学习
人工智能·学习·算法·语言模型·可信计算技术
Narv工程师5 小时前
嵌入式机器人控制器算力评估:从DMIPS到WCET的完整指南
人工智能·算法·机器学习
辰海Coding5 小时前
MiniSpring框架学习-为什么一个请求访问 /helloworld,最后能调用到某个 Controller 方法?原始 MVC实现
java·学习·程序人生·spring·mvc
AI医影跨模态组学5 小时前
J Thorac Oncol(IF=20.8)广东省人民医院钟文昭教授团队:基于影像组学的支持向量机区分驱动肺腺癌进展的分子事件
人工智能·深度学习·机器学习·论文·医学·医学影像·影像组学
凉、介5 小时前
深入理解 ARMv7-A|异常/中断处理
笔记·学习·嵌入式·arm
wxytxdy6 小时前
通过猜数字游戏学习Shell脚本的分支、循环编写
linux·学习