人工智能

流批一体随想

前言 好久不见(鞠躬 今年以来的主要工作方向之一就是部门内流批一体能力的建设与落地。虽然这个概念早已成为老生常谈,并且笔者现在还没什么fancy的成果(惭愧),但今天还是想随便写几句来聊聊。 Why? 考虑经典的Lambda Architecture。 这种架构的出现是历史必然,因为那时的流计算引擎以Storm为代表,而它们都无法提供Exactly-Once语义,所以任何一点小的扰动

651.【系统架构】边缘计算——边云协同(一)

边缘计算与云计算各有所长,云计算擅长全局性、非实时、长周期的大数据处理分析,能够在长周期维护、业务决策等领域发挥优势; 边缘计算更适用局部性、实时、短周期数据的处理与分析,能更好地支撑本地业务的实时智能化决策与执行。 因此边缘计算与云计算之间不是替代关系,而是互补协同关系,边云协同将放大边缘计算与云计算的应用价值: 边缘计算既靠近执行单元,更是云端所需高价值数据的采集和初步处理单元,可以更好地支

SpringBoot集成DeepSeek实现AI对话详细教程

1. 环境说明JDK17以上,SpringBoot3 以上版本 2. 引入依赖 <dependency> <groupId>org.springframework.ai</groupId> <artifactId>spring-ai-openai-spring-boot-starter</artifa

跟着Nature Communications学作图--复杂散点图

复杂散点图 从这个系列开始,师兄就带着大家从各大顶级期刊中的Figuer入手,从仿照别人的作图风格到最后实现自己游刃有余的套用在自己的分析数据上!这一系列绝对是高质量!还不赶紧点赞+在看,学起来! 参考文献 本期分享的是Nature Communications上一篇关于机器学习的文章中的散点图。 这个散点图的亮点在于充分利用了散点的填充和描边属性,将两者与图形要表达

Linux_116_raid级别

raid 技术分为多个级别,不同的级别,由于技术角度的考虑,还有公司运营成本的考虑,不同的企业选择不同版本的raid技术 raid 0 数据依次写入到物理硬盘,在理想状态下,写入速度是翻倍的 特点: 但凡任意坏了一块硬盘,数据都将被破坏。数据写入到2块硬盘中,没有备份的功能 读写效率更高,但是数据没有安全性保障 适用于追求极致性能的场景,而不关注于数据安全性的场景 由于raid0的特性

【kafka】kafka 在线增加分区副本数

创建 increase-replication-factor.json 文件 $ cat increase-replication-factor.json {"version":1, "partitions":[ {"topic":"testTopic","partition":0,"replicas":[0,1,2]}, {"topic":"testTopic","partition":1

AI 驱动游戏:鸿蒙生态的机会在哪里?

子玥酱 (掘金 / 知乎 / CSDN / 简书 同名) 大家好,我是 子玥酱,一名长期深耕在一线的前端程序媛 👩‍💻。曾就职于多家知名互联网大厂,目前在某国企负责前端软件研发相关工作,主要聚焦于业务型系统的工程化建设与长期维护。我持续输出和沉淀前端

市场洞察所需要的“数据”,是如何搜集的呢?

市场洞察所需要的“数据”,是如何搜集的呢? 一、传统的数据收集方法 1.1一手数据 一手数据,也称之为原始数据,是指通过人员访谈、询问、问卷、测定等方式,直接获得的新数据。 收集方法:定性调查与定量调查。 定性调查:主要通过一对一“深度访谈”,例如焦点座谈会。 定量调查:主要通过向消费者发送一个结构化的调查问卷获取数据。 两者可以结合使用,先定性调查挖掘未知、深度,然后定量调查实现数

方差分析、T检验、卡方分析如何区分?

差异研究的目的在于比较两组数据或多组数据之间的差异,通常包括以下几类分析方法,分别是方差分析、T检验和卡方检验。 三个方法的区别 其实核心的区别在于:数据类型不一样。如果是定类和定类,此时应该使用卡方分析;如果是定类和定量,此时应该使用方差或者T检验。 方差和T检验的区别在于,对于T检验的X来讲,其只能为2个类别比如男和女。如果X为3个类别

大数据:HDFS知识体系(知其然,知其所以然)

前言 HDFS是Hadoop体系的基础,不知道各位怎么对待HDFS。反正我更多的关注一些应用层的东西,对于HDFS多有忽视。 但是每次面试的时候都要重新去背面经,我觉得这样的情况不太正常,因此耗时两天半整理了HDFS的知识体系,力求知其然也要知其所以然。 文章中有不少个人思考,希望能让各位更好的理解HDFS. 一、HDFS特性 高容错性:HDFS认为硬件总是不可靠的。 高吞吐量:HDFS为大量