AI & Analytics

Verbetering van Lakebase Postgres compute cache

Databricks Blog
Verbetering van Lakebase Postgres compute cache

Samenvatting

Lakebase Postgres verdubbelt de throughput dankzij een vernieuwde compute-cache, met minder storage-reads en lagere latency.

Lakebase Postgres compute-cache: wat er gebeurt

Databricks beschrijft verbeteringen aan de cache op de Postgres-compute van Lakebase Postgres. De vernieuwde cache werkt samen met shared buffers en past zich aan de beschikbare compute aan via autoscaling.

De aanpak moet zoveel mogelijk data in DRAM beschikbaar houden. Productieresultaten laten volgens Databricks 2x throughput zien, naast minder reads uit de storage-laag en lagere latency. De verbeteringen zijn al naar klanten gebracht; de blog beschrijft ook plannen voor de nabije termijn.

Lakebase Postgres en het standaard Postgres-cachemodel

Standaard gebruikt Postgres shared buffers naast de page cache van het besturingssysteem. Dat leidt tot double buffering: dezelfde pagina kan in beide geheugengebieden staan. Bij een compute met 4 GB RAM en 1 GB shared buffers verbruikt het systeem daardoor 2 GB geheugen om 1 GB data te cachen.

Lakebase Postgres gebruikt disaggregated storage. Data komt daarbij niet via het filesystem of de page cache van het besturingssysteem binnen. Bovendien staat de omvang van shared buffers vooraf vast en vereist een wijziging een herstart. Dat botst met een serverless systeem dat compute automatisch aanpast.

De cache moet daarom rekening houden met de manier waarop Lakebase Postgres storage en compute scheidt. Ook het geheugenverbruik per actieve verbinding speelt mee: grotere shared buffers vragen extra geheugenbeheer door het besturingssysteem.

Concrete takeaway voor Lakebase Postgres

Controleer bij Lakebase Postgres-workloads niet alleen de databaseconfiguratie, maar ook de verdeling tussen compute-cache, shared buffers en storage-reads. Gebruik throughput, latency en het aantal reads uit de storage-laag als meetpunten wanneer je de nieuwe cache beoordeelt.

Lees het volledige artikel
Meer over AI & Analytics →