PostgreSQL 日报|备份单页损坏被静默忽略(8 月 18 日)
PostgreSQL 技术文章
LLM 应该放在后端
Neon 推出了 Neon AI Gateway,将 LLM 调用直接集成到 Neon 后端。开发者无需再分别管理各 AI 提供商的账号,可以像使用文件存储、函数和身份验证等后端功能一样,直接在 Neon 内部调用语言模型。这一设计将 AI 模型访问统一收归数据库平台管理,减少了基于 Neon 构建的应用对外部服务的依赖。
原文链接:
https://pgnexus.ai/tech-blogs?url=https%3A%2F%2Fneon.com%2Fblog%2Fllms-belong-in-your-backend
powa-archivist 5.3.0 正式发布!
powa-archivist 5.3.0 已正式发布。此版本主要修复了与 PostgreSQL 19 的兼容性问题,具体是适配 pg19beta2 中 pg_stat_lock.wait_time 字段数据类型的变更,该修复由 Julien Rouhaud 提交。powa-archivist 是 PoWA(PostgreSQL Workload Ana…
原文链接:
PostgreSQL CDC 工具在 YugabyteDB 上的工作原理
YugabyteDB 兼容 PostgreSQL 协议,但 CDC 工具能否真正正常运行是另一回事。作者 Bakul Gupta 对三款主流开源 CDC 连接器进行了实际场景测试,评估其与 YugabyteDB 的兼容性。文章指出,协议兼容只是基础,有一个核心概念对兼容性起着决定性作用,并逐一分析了各工具的表现。对于考虑将 YugabyteDB 用于数据管…
原文链接:
PostgreSQL Hacker 电子邮件讨论精选
BgBufferSync() 函数中 reusable_buffers 变量的含义解析
Xuneng Zhou 提交的补丁旨在澄清 BgBufferSync() 中 reusable_buffers 变量的含义,该补丁于 2025 年 5 月完成了 rebase。Ashutosh Bapat 在较长时间延迟后,将其添加至下一个 commitfest 以防遗漏,随后又为满足 CFBot 的要求再次进行了 rebase,无实际冲突。参与者…
原文链接:
pg_stat_database.checksum_failures 在备份中遗漏单页故障
Yilin Zhang 报告、Zsolt Parragi 分析的一个 bug 表明:当基础备份(base backup)恰好遇到一个损坏页面时,pg_stat_database.checksum_failures 不会被更新。原因是统计更新代码位于 checksum_failures > 1 的条件块内,导致单页损坏的情况被静默忽略。该问题自 co…
原文链接:
大型 WAL 记录的压缩策略
Surya Poondla 在审查 Andrey 提交的 WAL 记录压缩补丁(v1)时,发现了一个与 WAL-before-data 规则相关的正确性问题。该补丁在为 hint-only 变更写入紧凑记录时,未更新页面的 LSN。由于 FlushBuffer() 完全依赖页面 LSN 来保证 WAL 写入顺序,跳过 PageSetLSN() 会导致 XL…
原文链接:
https://pgnexus.ai/hacker-discussions?subject=Compression of bigger WAL records
数据校验和启动器中的 SIGINT 处理需要澄清或改进
该讨论围绕 data checksums launcher 中 SIGINT 信号处理的澄清或修复展开。相关补丁经过审查后已最终确定,Daniel Gustafsson 确认更改已提交,并将该开放项标记为已解决,计划次日继续处理其余待办事项。从现有消息来看,没有其他未解决的问题。参与此讨论的还有 Masao Fujii 和 Nathan Bossart。
原文链接:
利用 SIMD 加速 UUID 解析
Masahiko Sawada 提议通过在 UUID 输入函数中复用支持 SIMD 的 hex_decode_safe(),对 UUID 解析进行加速,在 canonical 格式下约有 5 倍性能提升。Haibo Yan 发现 hex_decode_safe() 会静默跳过空白字符,可能导致错误解析,解决方案是在解码结果长度不等于 16 字节时回…
原文链接:
https://pgnexus.ai/hacker-discussions?subject=Optimize UUID parse using SIMD
[补丁] test_decoding 输出中跳过虚拟生成列
该补丁旨在从 test_decoding 输出中省略虚拟生成列。目前,虚拟生成列在输出中显示为 null,与真正存储 NULL 值的列无法区分。Bharath Rupireddy 支持此修复,并指出 pgoutput 已通过 logicalrep_should_publish_column() 跳过虚拟生成列,同时提交了经过 pginden…
原文链接:
行业新闻
Amazon 销毁珍稀书籍用于训练 AI 模型引发争议
据报道,Amazon正在销毁珍本书籍,以将其用于大型语言模型的训练数据。由于互联网上的文本内容已被大量采集,稀有书籍因其独特性而成为AI训练的重要资源。此举引发了外界对文化遗产保护的广泛担忧。这一现象也折射出各大科技公司在高质量、新颖训练数据争夺上的日趋激烈。
原文链接:
Higgsfield 融资4亿美元B轮融资,8个月估值翻两番至54亿美元
AI图像和视频生成初创公司Higgsfield完成4亿美元B轮融资,估值在短短8个月内翻了四倍,达到54亿美元。该公司由前Snap高管Alex Mashrabov创立,旗下平台支持用户生成AI图像和视频。此轮融资规模庞大,再度印证了市场对生成式AI创意工具的强烈热情。
原文链接:
Wispr融资2.8亿美元估值达20亿美元,拓展业务超越语音听写
AI语音初创公司Wispr完成2.8亿美元融资,估值达20亿美元。该公司以语音听写工具起家,如今正将业务延伸至会议场景,并推出了全新的会议记录工具。本轮资金将用于拓展产品版图,加速其从单一听写工具向更广泛AI生产力平台的转型。此次融资也反映出市场对AI语音交互工具的持续看好。
原文链接:
社交媒体动态
Kubernetes 的 PostgreSQL Operator 已经不少,为何还要再造一个?
Kubernetes 生态中已有众多 PostgreSQL Operator,但 CYBERTEC 还是选择自研了一款——CYBERTEC PG Operator。其核心差异化在于专注多站点 PostgreSQL 部署,支持跨站点复制、自动故障转移和经过验证的部署模型,同时兼顾常规的生命周期管理。CYBERTEC CEO Hans-Juergen Scho…
原文链接:
Databricks 数千名工程师每天使用编程智能体,AI 支出已成为研发预算中增长最快的项目之一
在 Databricks,数千名工程师每天都在使用编程智能体,AI 支出因此成为研发成本中增长最快的项目之一。公司发现单一预算难以同时应对日常使用和异常消费,于是采用了双层管控机制:日预算用于拦截失控支出,工程师可自助申请提额;月预算针对较大规模的支出,需经项目立项并由主管审批。所有编程智能体均通过 Unity AI Gateway 路由,实现跨工具、跨模…
原文链接:
Databricks 平台新功能抢先看
Databricks 邀请客户参加定于 8 月 20 日举办的线上产品预览活动,届时将由产品负责人亲自主持。活动将涵盖多个平台方向的最新进展,包括 Genie、Genie Ontology、Unity AI Gateway、Lakebase、LTAP、Lakeflow、Lakehouse,以及统一安全、数据治理与开放数据共享等功能。参与者还可以直接向相关研…
原文链接:
以上信息来自 PGNexus( https://pgnexus.ai/home ),欢迎注册账号体验和订阅邮件获取每日更新。
PGNexus 是面向全球 PostgreSQL 用户、开发者与贡献者的一站式生态平台,汇聚技术博客、Hacker 邮件讨论、社区补丁分析、行业资讯及全球活动信息。同时,平台提供在线沙盒环境,用户无需本地部署,即可快速体验和验证 PostgreSQL 相关功能、SQL 语句与技术方案。通过智能化的信息筛选、内容提炼与实践工具,PGNexus 帮助用户更高效地了解 PostgreSQL 技术动态,参与社区协作,并完成从学习到验证的完整闭环。

浙公网安备 33010602011771号