Hadoop学习心得 【Hadoop 深度学习】拆解分布式存储与计算的底层逻辑(作为大数据技术栈的 “基石”,Hadoop 的核心组件(HDFS、MapReduce、YARN)是课程的重中之重。经过近两周的理论学习 + 集群实操,我终于从 “只会敲命令” 进阶到 “理解底层逻辑”,这篇心得带你从原理→实操→避坑全方位吃透 Had 大数据 2026年03月02日 200 点赞 0 评论 17970 浏览
计算机毕业设计hadoop+spark+hive旅游推荐系统 旅游可视化系统 地方旅游网站 旅游爬虫 旅游管理系统 大数据毕业设计 机器学习 深度学习 知识图谱 温馨提示:文末有 CSDN 平台官方提供的学长联系方式的名片! 温馨提示:文末有 CSDN 平台官方提供的学长联系方式的名片! 温馨提示:文末有 CSDN 平台官方提供的学长联系方式的名片! 技术范围:SpringBoot、Vue、爬虫、数据可视化、小程序、安卓APP、大数 大数据 2026年03月02日 68 点赞 0 评论 17990 浏览
Flink-sql-整理-窗口函数 1 窗口表值函数(Windowing TVFs)1.滚动窗口 2.滑动窗口 3.累积窗口 4.会话窗口 (目前仅支持流模式)**简述:**逻辑上,每个元素可以应用于一个或多个窗口,这取决于所使用的 窗口表值函数。例如:滑动窗口可以把单个元素分配给多个窗口。是 分组窗口函数 (已经过时) 大数据 2025年05月20日 171 点赞 0 评论 18042 浏览
数据科学在大数据领域的安全保障 数据科学在大数据领域的安全保障 关键词:数据科学、大数据领域、安全保障、数据加密、异常检测 摘要:本文聚焦于数据科学在大数据领域的安全保障问题。随着大数据时代的来临,数据的规模、多样性和流速都达到了前所未有的程度,数据安全面临着诸多挑战。数据科学凭借其独特的方法和技术,能够为大数据的安全保障提供有效的解决方案。文章将深入探讨 大数据 2026年04月14日 111 点赞 0 评论 18053 浏览
Dubbo- 主流注册中心介绍:Zookeeper/Nacos/Eureka 适配思路 👋 大家好,欢迎来到我的技术博客! 📚 在这里,我会分享学习笔记、实战经验与技术思考,力求用简单的方式讲清楚复杂的问题。 🎯 本文将围绕Dubbo这个话题展开,希望能为你带来一些启发或实用的参考。 🌱 无论你是刚入门的新手,还是正在进阶的开发者& 大数据 2026年04月16日 103 点赞 0 评论 18054 浏览
Hive的分区分桶和数据抽样 文章目录 分区 概念 分区表的操作 创建分区表 新建分区 导入数据到指定分区 写入数据到指定分区 删除分区 删除多个分区 查看分区 查看分区表结构 动态分区 1. 开启动态分区参数设置 2. 设置为非严格模式 3. 设置所有节点可创建的最大分区数 4. 设置单个节点可创建的最大分区数 5.设置整个MRJob可创建的最大文件数 6. 设置当有空分区产生时是否报错&#x 大数据 2025年05月23日 88 点赞 0 评论 18175 浏览
基于大数据爬虫+Python+SpringBoot+Hive的网络电视剧收视率分析与可视化平台系统(源码+论文+PPT+部署文档教程等) 博主介绍:CSDN毕设辅导第一人、全网粉丝50W+,csdn特邀作者、博客专家、腾讯云社区合作讲师、CSDN新星计划导师、Java领域优质创作者,博客之星、掘金/华为云/阿里云/InfoQ等平台优质作者、专注于Java技术领域和学生毕业项目实战,高校老师/讲师/同行前辈交流✌ 技术范围:SpringBoot、Vue、SSM、HLMT、Jsp、P 大数据 2025年04月26日 194 点赞 0 评论 18184 浏览
NVIDIA DGX Spark实战指南:从开箱到部署200B参数大模型 1. 开箱与初识:当超级计算走进你的桌面还记得几年前,想要跑一个像样的AI模型,要么得去租用昂贵的云端GPU实例,忍受网络延迟和排队等待,要么就得面对一台台嗡嗡作响、占地巨大的服务器机柜。那种感觉,就像你想喝杯水,却必须去管理一个水库。但今天,当我把NVIDIA DGX Spark从那个简约的牛皮纸盒里取出来时,这种印象被彻底颠覆了。它的尺寸,150mm x 150mm x 50.5mm,比一个i 大数据 2026年05月30日 196 点赞 0 评论 18191 浏览
Spark的shuffle史上最详细解析 , 应用场景等多维度 以下内容将对 Spark 中 Shuffle 的原理、流程、配置项、实际应用场景、常见问题及解决方案等进行全面、详细、细致的分析和阐述,并在必要处辅以示例和配置展示。最后会进行总结,同时给出项目中可能出现的场景、问题、优化方式,力求内容完善、翔实且具有可操作性。 一、Shuffle 的背景与概念 什么是 Shuffle? 在分布式计算框架& 大数据 2025年04月27日 138 点赞 0 评论 18224 浏览
大数据计算资源基础知识,以及5个核心技术讲解(hadoop、mapreduce、hive、spark、flink) 大数据计算资源基础知识 大数据处理基本背景大数据处理面临的主要挑战是数据量太大,无法在单台机器上高效处理。因此,需要分布式系统将数据和计算任务分散到多台机器上协同完成。根据处理方式和应用场景的不同,发展出了不同类型的计算资源。 批处理计算资源背景:最早的大数据处理方式,主要处理已经存储好的大量历史数据。 MapReduce& 大数据 2025年05月26日 33 点赞 0 评论 18236 浏览