大数据第六天

这里写目录标题

问题

FAILED: ParseException line 1:16 mismatched input 'input' expecting INPATH near 'local' in load statement

MismatchedTokenException(24!=155)

加载数据的时候出现了这个错误,我们解释一个这个错误是什么,具体说的是语法有问题,需要我们修改语法问题

失败:ParseException行1:16输入"input"不匹配,在load语句中应为靠近"local"的INPATH

MismatchedTokenException(24!=155)

这个翻译的原文

我导入的文件

这个才是正确的数据格式

解决问题

发现解决不了

这里写的就是有问题

错误的写法是 Input

正确的是 inpath

总是出现这个错误,我不知道怎么了

我就是在这个服务器上面还是还是没有成功

使用这个方式突然成功了

数据也没有问题

创建数据集表

数据

上传

结果

查询插入(时间慢)

INSERT INTO table student04 select id,name from student01 ;

这个时间大概有一个1分钟了把

练习sql

选择库

shell 复制代码
use test;

创建数据表的方式

shell 复制代码
CREATE table student04(
id int,
namet string
)
row format delimited
fields terminated by ',';

数据格式

加载本地数据库

shell 复制代码
load data local input '/root/hivedata/student.txt' into table student;

数据清理

有一些数据为空我们不需要如何进行处理的方式

我们只想要获取时间数据的方式

经纬度是一个数据如何分成俩个数据的方式

清理为空的数据

LENGTH(sender_gps) = 0

shell 复制代码
SELECT msg_time,sender_name,sender_gps from 
tb_msg_source 
WHERE  LENGTH(sender_gps) = 0
limit 10

获取时间段的数据

SUBSTR(msg_time,12,16)

shell 复制代码
select SUBSTR(msg_time,12,16) from tb_msg_source limit 10; 

分割数据的方式

split(sender_gps,",")[1]

shell 复制代码
SELECT split(sender_gps,",")[1] from tb_msg_source 
相关推荐
Lx35219 分钟前
YARN资源调度优化:最大化集群利用率
大数据·hadoop
智能化咨询25 分钟前
【56页PPT】数字化智能工厂总体设计SRMWCSWMSMES&EMS系统建设方案(附下载方式)
大数据·云计算
在未来等你32 分钟前
Elasticsearch面试精讲 Day 12:数据建模与字段类型选择
大数据·分布式·elasticsearch·搜索引擎·面试
Leo.yuan41 分钟前
不同数据仓库模型有什么不同?企业如何选择适合的数据仓库模型?
大数据·数据库·数据仓库·信息可视化·spark
chat2tomorrow1 小时前
数据采集平台的起源与演进:从ETL到数据复制
大数据·数据库·数据仓库·mysql·低代码·postgresql·etl
TDengine (老段)2 小时前
TDengine 选择函数 Max() 用户手册
大数据·数据库·物联网·时序数据库·tdengine·涛思数据
乐迪信息2 小时前
乐迪信息:AI摄像机在智慧煤矿人员安全与行为识别中的技术应用
大数据·人工智能·算法·安全·视觉检测
万邦科技Lafite4 小时前
实战演练:通过API获取商品详情并展示
大数据·数据库·python·开放api接口
在未来等你4 小时前
Elasticsearch面试精讲 Day 14:数据写入与刷新机制
大数据·分布式·elasticsearch·搜索引擎·面试
黄焖鸡能干四碗5 小时前
智慧教育,智慧校园,智慧安防学校建设解决方案(PPT+WORD)
java·大数据·开发语言·数据库·人工智能