logo 信觅博客
Loading...

技术研发

数据库设计|应用开发|软件测试|工程实践

本期更新
2026-09-03

数据库设计与开发

  • • 嵌入式数据库引擎架构研发
  • • MVCC并发控制、索引、存储模型
  • • SQL解析、事务、性能调优
  • • 信创数据库适配、FTO检索

应用开发 & 测试

  • • 后端服务、模块化架构设计
  • • 单元、集成、自动化测试方案
  • • 工程构建、性能压测、故障排查
  • • 跨平台软件稳定性优化

研发工程实践

  • • 需求分析、方案选型、架构设计
  • • 开源项目规划、软著专利申报
  • • 技术文档、基准性能测试Benchmark
  • • 技术风险评估、商业化分析

技术前沿速递

开源生态与引擎架构动态 · 每期精选
开源数据库 · PostgreSQL · 头条

PostgreSQL 19 Beta1:REPACK CONCURRENTLY、属性图查询、并行 autovacuum

PostgreSQL 19 首个 Beta 发布,带来一系列内核级增强:新增 REPACK 与 REPACK CONCURRENTLY 在线重组、减少表膨胀维护窗口;引入 SQL/PGQ 属性图查询(Property Graph Queries)支持图模型表达;逻辑复制扩展到序列(sequences);autovacuum 支持并行、外键约束构建约 2 倍提速;新增 WAIT FOR LSN 与 pg_plan_advice 规划建议。作为全球最活跃的开源关系型内核,PG 在向量检索、逻辑复制与扩展生态上的持续演进,继续是国产库与云厂商的重要上游参照。

PG 19 REPACK CONCURRENTLY SQL/PGQ 并行 autovacuum
PostgreSQL 官方 · Neon 原文
国产数据库 · 多写 · 头条

openGauss 7.0.0-RC1:oGRAC 多写架构、行列转换、智能慢 SQL 诊断

openGauss 7.0.0-RC1 发布,核心亮点是 oGRAC 多写架构与行列转换能力:备机以列存形式承接查询、查询性能可达行存约 5 倍;新增智能慢 SQL 诊断与 APPLY JOIN 等能力,进一步模糊 OLTP 与 OLAP 边界。oGRAC 多写把"同一份数据的多写多读"做成内核级能力,与当下 Agent 高频读写、HTAP 混合负载的需求高度契合,也为自研引擎的并发路径设计提供了对照样本。

oGRAC 多写 行列转换 5× 慢 SQL 诊断 APPLY JOIN
极客公园 · openGauss 官网 原文
向量数据库 · Agent Memory

AI 原生数据库四大流派:通用内核原生增强 vs 外挂记忆集成

围绕 Agent Memory 与向量检索,业界分化出两条主线:其一是通用内核原生增强,PolarDB AI、海山数据库、OceanBase AI、TiDB 等把向量、图、文档纳入统一内核;其二是外挂集成,Mem0、Zep、LangMem、Letta 等以独立记忆层对接各类模型。前者胜在一致性与事务保障,后者胜在灵活与快速迭代——"库内原生"与"外挂记忆"的路线之争,本质是"把智能放进数据"还是"把数据喂给智能"的架构取舍。

PolarDB AI OceanBase AI Mem0 / Zep 原生 vs 外挂
51CTO · 行业观察 原文
AI 半导体 · 基础设施

博通 FY2026 Q3 AI 半导体 +221%:定制硅成云厂商自建 AI 基建核心

博通公布 2026 财年第三季度财报:营收 295.91 亿美元、同比增 86%,其中 AI 半导体收入 167 亿美元、同比增 221%,并上调 2028 财年 AI 营收指引至 2300 亿美元。定制硅(Custom Silicon)成为云厂商自建 AI 基础设施的核心组件,这一信号对数据库的意义在于:底层加速硬件正从"通用 GPU"走向"为特定负载定制的芯片",存储侧计算卸载、向量加速等"软硬协同"路线的重要性持续上升。

Custom Silicon AI 半导体 167 亿 +221% 软硬协同
东方财富 · 新浪财经 原文
大模型 · 智能体 · 安全

谷歌 Gemini 3.8 Flash & 3.8 Flash Cyber:六周第三次 Flash,DeepSWE 73.7%

谷歌 9 月 2 日发布 Gemini 3.8 Flash 及面向网络安全的 3.8 Flash Cyber,六周内第三次 Flash 迭代。3.8 Flash 在软件工程基准 DeepSWE 达 73.7%;3.8 Flash Cyber 面向威胁狩猎、漏洞分析与事件响应,在 CyberGym 达 86.2%,以 Fairwind Program 受限开放给企业安全团队。高频迭代印证"轻量模型 + 高频刷新"成为竞争新范式,也对"本地长上下文 + 库内推理"的端侧数据系统提出新需求。

Gemini 3.8 Flash DeepSWE 73.7% CyberGym 86.2% 高频迭代
新浪科技 · KOL 原文
国产算力 · 芯片 · 资本

燧原科技登陆科创板:国产 GPU"四小龙"最后一块拼图,募资 61.19 亿

国产 AI 芯片企业燧原科技(688801)在科创板上市,发行价 142.18 元/股、募资 61.19 亿元、网上中签率 0.02455315%。作为国产 GPU"四小龙"(寒武纪、壁仞、摩尔线程、燧原)中最后一块拼图,燧原的上市标志着国产训练/推理芯片阵营在资本市场完成集结,为"国产模型 + 国产算力"正循环补充资本弹药,也为底层数据库"多架构可移植"提出更明确的工程要求。

燧原 688801 61.19 亿募资 GPU 四小龙 多架构可移植
中新网 · 新浪财经 原文
数字经济 · 词元经济学

词元(Token)日均调用近 175 万亿:中文名 3 月定,Token 经济学成形

"Token"中文名"词元"于今年 3 月确定,成为 AI 服务的统一计量单位;2026 年 6 月我国词元日均调用量已近 175 万亿次,较 2024 年初约 1000 亿次实现千倍增长。当算力、数据、模型被同一把"词元"标尺计量,"每一次访问可追踪、每一元投入可计量"就从口号变成数据库系统的原生能力要求——把算力使用、数据血缘、访问审计做成内置能力,才能接入国家级算力市场。

词元 Token 175 万亿 / 日 千倍增长 可计量原生
央视网 · 网易 原文
信创算力 · 产业底座

国产 AI 芯片 2026 份额望近 90%:需求 400 万颗 / 供给 300 万颗,百万级缺口

最新数据显示,2026 年国产 AI 芯片需求约 400 万颗、交付约 300 万颗,存在百万级缺口;国产份额约 41%(2025),TrendForce 预测 2026 年有望接近 90%。截至 6 月底我国智能算力规模达 2185 EFLOPS、同比增 177%、建成 42 个万卡集群。在推理算力需求反超训练、长上下文与 Agent 普及的背景下,"训推一体 + 国产化"成为算力建设主线,信创算力底座自主可控的重要性进一步凸显。

国产 41%→90% 400 万 / 300 万颗 2185 EFLOPS 训推一体
21 世纪经济报道 · 每经 原文

研发视角

本期技术主线由"数据库原生 AI"与"软硬协同"两条线共同定调。关系型内核持续向"在线维护 + 多模型"演进:PostgreSQL 19 Beta1 带来 REPACK CONCURRENTLY 在线重组、SQL/PGQ 属性图查询、逻辑复制扩展到序列、并行 autovacuum 与外键约 2 倍提速——维护窗口与一致性保障是生产系统的硬约束,PG 把这些能力做成内核原语,正持续抬高行业基线;openGauss 7.0.0-RC1 的 oGRAC 多写架构 + 行列转换(备机列存查询约 5 倍) + 智能慢 SQL 诊断,则把"同一份数据的多写多读"做成内核级能力,与 Agent 高频读写、HTAP 混合负载的需求高度契合。

模型与数据系统的关系,本期呈现出清晰的"路线之争"。围绕 Agent Memory 与向量检索,业界分化为"通用内核原生增强"(PolarDB AI、海山、OceanBase AI、TiDB 把向量/图/文档纳入统一内核)与"外挂记忆集成"(Mem0、Zep、LangMem、Letta 独立记忆层)两条主线——前者胜在一致性与事务保障,后者胜在灵活与快速迭代。对自研引擎而言,这恰是"列存 + 向量 + 计算下推"路线的外部印证:把向量检索、结构化查询与本地模型推理做成同进程、零搬运的原生能力,比"数据出库再喂给模型"更稳、更可审计。底层架构上,博通 AI 半导体同比 +221%、定制硅成为云厂商自建 AI 基建核心,叠加上文 2185 EFLOPS 国产算力规模,共同指向一个结论——"多架构可移植 + 计算卸载友好"是下一代自研引擎必须提前布局的方向。

资本与产业信号同样清晰:燧原科技登陆科创板募资 61.19 亿元,国产 GPU"四小龙"在资本市场完成集结,国产 AI 芯片 2026 年份额有望从 41% 跃升至近 90%——"国产模型 + 国产算力"正循环正在形成,底层数据库"多架构可移植、计算卸载友好"的工程要求变得空前具体。而词元(Token)日均调用近 175 万亿、较 2024 年初千倍增长,则把"算力使用可计量、数据血缘可追踪、访问审计可举证"从口号变成接入国家级算力市场的硬门槛。

落到我们自身的工程节奏:FCDB 自研数据库引擎正围绕千万至亿级(5000 万–1 亿行)数据读写与多写多读并发场景,持续扩充回归测试集与规模化稳定性压测。两点进展值得记一笔:其一,多写多读并发路径的边界用例与一致性校验(增量 WAL 崩溃恢复、MVCC 快照隔离、行/表级锁)已建立并纳入回归,异常分支的可复现与收敛效率提升;其二,大数据量下的读写吞吐与延迟基线被持续跟踪,并固化为版本迭代的量化门槛。当端侧长上下文、库内向量、存储侧计算卸载成为行业标配,FCDB 的"列存 + 向量 + 计算下推"路线更显确定性——自主可控、可审计、可配置,就是竞争力。

0