PostgreSQL 如何走向更强的分析型执行路径?mxvector 的一次实践
数据库原理
前言最近笔者在 PGConf 上分享了一篇关于 YMatrix mxvector 的主题 —— How to implement high performance pluggable vectorized executor (PPT 可以下载了)
在这次分享中,我想分享的是 PostgreS...
聊聊 PG 中的并行顺序扫描
数据库原理
前言最近花了点时间看了下 PG 中的并行顺序扫描的实现,有了一些新的认知和思考。
页面如何分配?首先是页面分配的问题,假如现在有个表 t,总共 100 个页面,那这些页面是如何分配给多个 worker 的?是人人平等,还是动态分配,亦或是纯随机乱扫?其实对于并行顺序扫描,其核心机制是:多个 w...
为什么 pgvector 会将索引限制在 2000 维?
PostgreSQL 生态
前言对于 pgvector,不管是 IVFFlat 还是 HNSW,对于 vector 类型,都有着明确的 up to 2,000 dimensions 的限制 — 即最大 2K 维,那么为何会有这样的限制?
先入为主的片面需要注意的是,前面提到的 2K 维限制是索引层的限制,而不是向量列本身...
2026/03/11
PostgreSQL 生态
PG 18 让 NUMA 可观测、可感知
新特性解读
前言在 18 的新版本中,包含了诸多惹眼特性,比如异步 I/O、BTREE Skip Scan、UUIDv7 等等,其实在 18 的新版中,还引入了一项很重要的特性 — NUMA 感知,一直以来,PG 就缺乏 NUMA 的可观测性,希望能看到 buffer 属于哪个 node、sha...
AI 时代的超级个体会越来越多
个人感想
前言最近发现我身边很多朋友都出来单干了,一人成立一个公司,有些可能是现实因素所逼,也有些是想借助于 AI 干点事情,那么为什么会发生这样的现象?
第一,供给侧变了:个人的生产力被 AI 放大了。
过去一个人做公司,最大的瓶颈是:写代码、做设计、写文案、做调研、做客服、做销售跟进,这些都需要人。...
2025 年终总结
年终总结
前言2025 这一年,忙到极致,也成长得很快,技术在跑,英语在追,团队也在扩。不过回头看,做事的主线没变。
工作今年工作是真忙,国内项目本身就够吃一壶了 (是的,写下这篇年终总结的今年,我还忙到了凌晨两点),自从开始负责海外项目,那是更忙了。时差是一方面,语言是另一方面,挑战很大,但成长也很实...
干中学的重要性
个人感想
一直以来,我的弱势就是英语,尤其是口语。不是不想学,而是国内环境确实没什么地方能天天开口练,光靠背单词、记语法,效果非常有限 —— 不说、不练,没几天就忘得差不多了。最近跑国外来了,一回生二回熟,这边客户也说英语,我也只能用英语交流。
说实话,刚开始压力挺大,尤其是为了培训,哐哐哐提前写了一大...
PG 家族的另一面:Greenplum 生态的裂变与传承
Greenplum
前言由于 PostgreSQL 协议开放、生态繁荣、架构优雅,全球范围内涌现出了大量基于 PostgreSQL 衍生的数据库产品,国内也有大量国产数据库基于 PG 高屋建瓴,开枝散叶。2025 年初,Broadcom 宣布 Greenplum 不再完全开源,一石激起千层浪,在社区中引起了强烈反...
pgAdmin 4:从“灾难现场”到“贴心小助手”的逆袭之路
SQL 优化
前言各位老铁国庆好,今日闲来无事下了个最新版的 pgAdmin4 玩玩,印象中的 pgAdmin4 仍停留在一个简单的管理工具,pgAdmin 4 的早期版本 (尤其 v1~v3) 用户体验相当糟糕,性能也差。社区甚至有人调侃”pgAdmin 3 是经典,4 是灾难”。
今天一用才发现,这家伙...
PgSQL + pgvector — 不止存储,更懂智能
PostgreSQL 生态
前言向量数据库在 AI 与大模型(LLM) 领域中是个至关重要的组件,主要承担”记忆与检索”的角色,其解决了大模型不能长期存储海量知识、推理效率受限的问题,无论是 RAG、推荐系统还是智能搜索,向量数据库都提供了”相似度搜索”的能力,让模型能找到相关上下文,而不仅仅依赖参数记忆。这其中,pgv...
2025/09/14
PostgreSQL 生态