大数据

头歌|HBase的安装与简单操作

若未出现预期结果可私信我答疑 我是头歌闯关王涉猎头歌7千多关,如有其他关卡也可私信我 第1关:Hbase数据库的安装mkdir /app cd /opt tar -zxvf hbase-2.1.1-bin.tar.gz -C /app vim /app/hbase-2.1.1/conf/hbase-env.sh !!!进入vim界面按i进入编辑模式,将第28行

VMware平台的Ubuntu部署完全分布式Hadoop环境

前言:此文章是本人初次部署Hadoop的过程记录以及所遇到的问题解决,这篇文章只有实际操作部分,没有理论部分。因本人水平有限,本文难免存在不足的地方,如果您有建议,欢迎留言或私信告知于我,非常感谢。 部分参考网络资料,如有侵权,联系删除。 文章目录 前言&#xf

数智读书笔记系列032《统一星型模型--一种敏捷灵活的数据仓库和分析设计方法》

引言在当今数字化时代,数据仓库作为企业数据管理的核心基础设施,承担着整合、存储和提供企业数据的关键角色。随着商业环境的快速变化和业务需求的日益复杂,数据仓库的设计方法也在不断演进,以适应新的挑战和要求。 背景与意义数据仓库领域长期存在着两种主流方法论之争:Bill Inmon提出的自上而下企业级数据仓库方法和Ralph Kimball倡导的自下而上维度建模方法。这两种方法各有优劣,但在应对现代企

数据仓库是什么? 一文带你看清它的架构

一、数据仓库是什么诞生背景数据仓库最早的出现,其实是为了解决某些现实问题:企业运营时间一长,大量老旧数据堆积在业务系统里,既没人查,也不能删,占空间、拖性能。于是人们想:能不能把这些“冷数据”挪到另一个专门的仓库里?这就成了数据仓库的第一个用途:“历史数据的安置房”。另外&

Kafka 和 Flink的讲解

一、Kafka:分布式消息队列1. 核心概念 ​​角色​​:Kafka 是一个分布式、高吞吐量的​​消息队列​​(Pub-Sub 模型),用于实时传输数据流。 ​​关键术语​​: ​​Producer​​(生产者):发送数据的客户端(如传感器、应用日志)。 ​​Consumer​​(消费者):接收和处理数据的客户端(如 Flink、Spark)。 ​​Broker​​

MapReduce报错 HADOOP_HOME and hadoop.home.dir are unset.

运行课程讲解内容出现这个报错: 1、在电脑里解压之前发过的Hadoop安装包 2、配置用户变量 3、配置系统变量 4、配置系统Path变量 5、下载链接的两个文件:链接: ?pwd=56tv 提取码: 56tv –来自百度网盘超级会员v7的分享6、放到刚刚解压路

高效查询Redis中大数据的实践与优化指南

个人名片 🎓作者简介:java领域优质创作者 🌐个人主页:码农阿豪 📞工作室:新空间代码工作室(提供各种软件服务) 💌个人邮箱:[2435024119@qq.com] 📱个人微信:15279484656 &#x1f310

计算机毕业设计Hadoop+Spark+DeepSeek-R1大模型民宿推荐系统 hive民宿可视化 民宿爬虫 大数据毕业设计(源码+文档+PPT+讲解)

温馨提示:文末有 CSDN 平台官方提供的学长联系方式的名片! 温馨提示:文末有 CSDN 平台官方提供的学长联系方式的名片! 温馨提示:文末有 CSDN 平台官方提供的学长联系方式的名片! 作者简介:Java领域优质创作者、CSDN博客专家 、CSDN内容合伙人、掘金特邀作者、

【Rabbitmq篇】高级特性----TTL,死信队列,延迟队列

目录一.TTL        1.设置消息的TTL2.设置队列的TTL3.俩者区别 二.死信队列定义:消息成为死信的原因:1.消息被拒绝(basic.reject 或 basic.nack)2.消息过期(TTL)3.队列达到最大长度 ​编辑 死信队列的应用场景三.延迟队列  定义:应用场景 实现一&#

window下安装并启动kafka

进入Kafka官网:Apache Kafka下载最新版Kafka 2.将Kafka路径配置到windows环境变量下(KAFKA_HOME),并将其添加到path中(方法同上) 3.进入E:\midware\kafka_2.13-3.9.0,创建2个自定义文件夹mydata,mylog 4.修改zk的配置文件