上一页 1 2 3 4 5 6 7 ··· 53 下一页
摘要: 好的,这是 PostgreSQL 中常用数据类型的整理表格。 ### PostgreSQL 常用数据类型速查表 | 类型名称 | 存储空间 | 别名 | 数据范围 | 类型说明 | 数据样例 || : | : | : | : | : | : || **整数类型** | | | | | || `SMA 阅读全文
posted @ 2025-12-12 14:41 ---江北 阅读(108) 评论(0) 推荐(0)
摘要: 在大数据引擎(如Hive SQL)中,复杂数据类型(如 `ARRAY`、`MAP`、`STRUCT` 和 `JSON`)的构造和提取是常见操作。以下详细说明其用法: ### 一、复杂类型的构造方法#### 1. **ARRAY(数组)**- **构造语法**:`ARRAY(element1, ele 阅读全文
posted @ 2025-12-12 09:06 ---江北 阅读(55) 评论(0) 推荐(0)
摘要: 首先需要创建赋值节点,这里通过shell创建: #!/bin/bash # 紧凑格式: 20250101,20250102,20250103 start="20250101" end="20250103" result="" current=$start while [ "$current" -le 阅读全文
posted @ 2025-12-02 16:48 ---江北 阅读(29) 评论(0) 推荐(0)
摘要: 入门:https://zhuanlan.zhihu.com/p/1941451140853135196 Apache Paimon 不是一个独立存储系统,也不是纯管理平台,而是一个数据湖存储框架(表格式)。它的存储依赖于外部分布式文件系统或对象存储(如HDFS、S3、OSS等),但自身提供了数据组织 阅读全文
posted @ 2025-11-26 14:13 ---江北 阅读(19) 评论(0) 推荐(0)
摘要: https://help.aliyun.com/zh/maxcompute/use-cases/check-whether-partition-pruning-is-effective?spm=a2c4g.11186623.0.0.290e1eddWQiIZE#concept-vjf-sxd-5db 阅读全文
posted @ 2025-11-25 17:20 ---江北 阅读(21) 评论(0) 推荐(0)
摘要: 离线->实时的区别: 典型传统实时分层方案1: 链路复杂,资源消耗极大,且中间层难以追溯,除非新增持久化 典型传统实时分层方案2: 形成准实时方案: 进化为物化视图: holo实现的实时数仓方案: 主要得益于holo与flink的集成: 核心的binlog能力: 存储方面也支持行列共存: 最佳实践1 阅读全文
posted @ 2025-11-21 14:10 ---江北 阅读(16) 评论(0) 推荐(0)
该文被密码保护。 阅读全文
posted @ 2025-11-21 13:53 ---江北 阅读(0) 评论(0) 推荐(0)
摘要: 引入依赖: <!-- Logback 日志依赖 --> <dependency> <groupId>ch.qos.logback</groupId> <artifactId>logback-classic</artifactId> <version>1.2.12</version> </depend 阅读全文
posted @ 2025-11-05 15:30 ---江北 阅读(25) 评论(0) 推荐(0)
摘要: 传统方式(使用CTE): sql WITH ranked_data AS ( SELECT user_id, ip, country_code, os, RANK() OVER (PARTITION BY user_id ORDER BY log_datetime DESC) AS previous 阅读全文
posted @ 2025-10-20 16:53 ---江北 阅读(49) 评论(0) 推荐(0)
摘要: 算子分类: 注意,使用lambda表达式的时候,需要注意类型推断的问题,首推内部类或者单独实现接口的类。 基础转换: map 1对1,flatmap 1对多,filter 过滤。 keyby:逻辑上将流划分为不相交的分区,具有相同 key 的记录会被分配到同一个分区。 KeyedStream<MyE 阅读全文
posted @ 2025-10-08 14:25 ---江北 阅读(19) 评论(0) 推荐(0)
上一页 1 2 3 4 5 6 7 ··· 53 下一页
TOP