爱纹身的big数据
码龄8年
求更新 关注
提问 私信
  • 博客:101,113
    社区:72
    动态:34
    101,219
    总访问量
  • 73
    原创
  • 69
    粉丝
  • 41
    关注
IP属地以运营商信息为准,境内显示到省(区、市),境外显示到国家(地区)
IP 属地:广东省
加入CSDN时间: 2019-01-09

个人简介:00后大数据菜鸟boy.

博客简介:

一个有趣的人,咱们处处看!

查看详细资料
个人成就
  • 获得63次点赞
  • 内容获得17次评论
  • 获得166次收藏
  • 代码片获得146次分享
  • 博客总排名1,916,412名
创作历程
  • 1篇
    2023年
  • 2篇
    2022年
  • 3篇
    2021年
  • 45篇
    2020年
  • 22篇
    2019年
成就勋章
TA的专栏
  • Hbase
    8篇
  • Spark
    10篇
  • 笔记
    1篇
  • Flink
    1篇
  • Linux
    11篇
  • CentOS7
    2篇
  • Scala
    7篇
  • Kafka
    5篇
  • Redis
    6篇
  • Yarn
    2篇
  • Flume
    1篇
  • Hive
    4篇
  • sqoop
    1篇
  • Hadoop
    4篇
  • MapReduce
    6篇

TA关注的专栏 0

TA关注的收藏夹 0

TA关注的社区 3

TA参与的活动 0

兴趣领域 设置
  • 大数据
    hadoophivesparketl
创作活动更多

AtomGit「码动四季·开源同行」秋季征稿活动

秋季征稿主题:开源成果经验分享 成果不止一种形态,我们为你准备了六大赛道,总有一款适合你: 开源项目成果复盘 把项目一年/一季的成长摊开来看:里程碑复盘、Star 与用户增长复盘、版本迭代复盘、从 0 到 1 的发布复盘。 🖊️ 示范选题: ●开源项目从 0 到 1000 Star,我做对了什么 ●开源一周年,我交出的成绩单 这类文章不只是一次经验分享,也是一张项目名片。欢迎将项目托管到 AtomGit 并申请成为 G-Star 项目,通过后可获得平台流量推荐、项目宣传等权益。(G-Star:AtomGit 最具影响力开源项目) ![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/1f90c61528ad410d8d66f9d0e3707a5a.png) 咨询 G-Star 项目申请 2️⃣ 技术经验体系化沉淀 踩坑合集、最佳实践总结、工具链实战、CI/CD 流水线搭建、代码重构与架构演进。 🖊️ 示范选题: ●提了 50 个 PR 后,我总结的开源协作避坑清单 ●一次重大重构复盘:把单体拆成可维护的模块 3️⃣ AI 赋能开源的实战成果 AI 编程助手实战测评、基于开源模型的微调与应用开发、AI 辅助研发提效流水线。 🖊️ 示范选题: ●我用 AI 编程助手把提 PR 效率翻了 3 倍 ●基于开源大模型搭了个 XX 工具(附完整教程) 4️⃣ 开源共建笔记|文档、社区与布道 开源文档写作与翻译、issue 互助经验、组织 meetup、用开源项目做教学与分享。 🖊️ 示范选题: ●一个优秀开源项目,文档应该怎么写 ●我用开源项目做了个线上 Workshop ![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/23e83ceebc594c379f7fc6aa8dcfa40c.png) 扫码加入码动四季投稿交流群,和更多伙伴一起交流技术!

39人参与 去参加
  • 最近
  • 文章
  • 专栏
  • 代码仓
  • 资源
  • 收藏
  • 关注/订阅/互动
更多
  • 最近

  • 文章

  • 专栏

  • 代码仓

  • 资源

  • 收藏

  • 关注/订阅/互动

  • 社区

  • 帖子

  • 问答

  • 课程

  • 视频

搜索 取消

惊了!10万字的Spark全文!

今天给大家分享一篇小白易读懂的 Spark万字概念长文,本篇文章追求的是力求精简、通俗易懂。希望能为新手的入门学习扫清障碍,从基础概念入手、再到原理深入,由浅入深地轻松掌握Spark。
原创
博文更新于 2023.03.29 ·
3912 阅读 ·
6 点赞 ·
0 评论 ·
4 收藏

老弟手把手教你编译Spark3.2.1源码!!!!!

一年多没更新博客了,这一年博主经历了很多,也学到了很多,近期会持续更新文章,主题不固定,哦,对了,博主跟几个朋友一起创建了一个大数据的技术社区,我们每周都会有技术分享以及技术交流的会议,目前社区人数高达800+,感兴趣的朋友可以扫描上方的二维码关注下社区的公众号,同时也可以添加博主的VX,邀你进群咱们一起交流啊!
原创
博文更新于 2023.03.29 ·
991 阅读 ·
0 点赞 ·
3 评论 ·
2 收藏

这......Spark面试题!

1.什么是 Apache Spark? 它有什么特点?Apache Spark是一个分布式计算框架,它可以在大规模数据集上进行高效的数据处理和分析。它最初由加州大学伯克利分校的AMPLab开发,并于2013年成为Apache软件基金会的顶级项目。Apache Spark的特点包括:快速:相比于传统的MapReduce计算框架,Spark的计算速度更快。这是因为Spark使用内存计算,能够更高效地管理数据,同时也支持内存缓存。易于使用:Spark提供了Scala、Java、Python、R等
原创
博文更新于 2023.03.29 ·
2463 阅读 ·
0 点赞 ·
1 评论 ·
5 收藏

Ali神龙JDK,内包含JDK1.8和JDK11,且支持X86和ARM框架

发布资源 2022.10.21 ·
zip

Arm架构下的hadoop-aarch64-3.3.1版本安装包

发布资源 2022.10.21 ·
zip

nexmark源码包-可用于flink和spark测试基准

发布资源 2022.10.21 ·
zip

Arthas开源Java诊断工具包

发布资源 2022.10.21 ·
gz

cloudera-manager-server-6.3.1-1466458.el7.x86_64.rpm

发布资源 2021.04.06 ·
rpm

cloudera-manager-agent-6.3.1-1466458.el7.x86_64.rpm

发布资源 2021.04.06 ·
rpm

kettle连接clickhouse驱动

发布资源 2021.04.06 ·
zip

apache-kylin-3.1.0-bin-cdh60.tar.gz

发布资源 2021.04.06 ·
gz

大数据基础面试宝典.zip

发布资源 2021.03.01 ·
zip

apache-phoenix-4.14.0-cdh5.14.2-bin.tar.gz

发布资源 2021.04.06 ·
gz

hiveIDEAjar.zip

发布资源 2021.04.06 ·
zip

cloudera-manager-server-db-2-6.3.1-1466458.el7.x86_64.rpm

发布资源 2021.04.06 ·
rpm

apache-hive-3.0.0-bin.tar

发布资源 2021.04.06 ·
tar

浅谈数据湖的探究与调研!

注: 对于数据湖博主也是近期开始研究探索的,下面给大家简单的聊一聊数据湖。浅谈数据湖的探究与调研!1、什么是数据湖(Data lake)?数据湖是目前比较热的一个概念,许多的企业都在构建或者计划构建自己的数据湖。但是在计划构建数据湖之前,要搞清楚什么是数据湖,要明确一个数据湖项目的基本组成,从而去进行设计数据湖的基本架构,对于数据湖的构建至关重要。关于什么是数据湖?有不同的定义。Wikipedia(维基百科)上说数据湖是一个以原始格式存储数据的存储库或系统、它按原样存储数据,而无需事先对数据进.
原创
博文更新于 2021.04.04 ·
1851 阅读 ·
0 点赞 ·
0 评论 ·
6 收藏

带你认识Apache的顶级项目Flink!

注: 对于Flink呢博主也是在开始进行深度的一个学习,其次就是Flink这个框架很值得去学习,有很大的学习价值,博主也是一个00后的大数据程序员,这条路很难,但是我坚信只要努力坚持的走下去,还是会有很大的收获的。一 flink 简介1.1 什么是 Flink?Apache Flink 是由 Apache 软件基金会开发的开源流处理框架,其核心是用 Java 和 Scala 编写的分布式流数据流引擎。Flink 以数据并行和流水线方式执行任意流数据程序,Flink 的 流水线运行时系统可以执行批.
原创
博文更新于 2021.01.16 ·
1300 阅读 ·
0 点赞 ·
1 评论 ·
0 收藏

大数据之Hadoop面试官的11个灵魂拷问!

久违了各位,好长时间没更新了,博主也是有点懒!!!今天就给各位更新一些Hadoop高端面试题,也是博主这一年面试所遇到的问题,其中还包括一些大厂的面试真题!注:喜欢的朋友们给个关注,一键三连一下吧! 谢谢1、先说一下hadoop的组成结构把!1.HDFS 管理者:namenode工作者:DataNode辅助管理者:secondaryNameNode2.MapReduce3.YARN管理者:ResourceManage工作者:NodeManage2、常用的端口号有哪些?dfs
原创
博文更新于 2021.01.14 ·
823 阅读 ·
0 点赞 ·
0 评论 ·
1 收藏

教你快速搭建Kafka集群(2)——Kafka集群安装部署

上一篇快速认识Kafka阶段(1)——消息队列,Kafka基本简介给大家简单介绍了消息队列和kafka的一些基本内容,下面教大家怎样去安装部署Kafka集群哦!!!!!!码字不易 先点个赞吧!1、初始化环境准备安装jdk,安装zookeeper并保证zk服务正常启动2、下载安装包并上传解压点击文字下载Kafka安装包提取码:r766 node01执行以下命令,下载并解压cd /...
原创
博文更新于 2020.03.22 ·
3658 阅读 ·
2 点赞 ·
0 评论 ·
19 收藏
加载更多