@lobsters Absolutely Everything You Always Wanted to Know About Watermarks in Apache Flink #Tech #DataEngineering #ApacheFlink
@hackernews Fast drilldown dashboards from a single Parquet file #HackerNews #Tech #DataEngineering
@netflix_tech A Tale of Two Flink Autoscalers #Tech #DistributedSystems #DataEngineering
@hackernews Indexing the Data Lake for Online Point Queries #HackerNews #Tech #DataEngineering
@spotify_engineering Indexing the Data Lake for Online Point Queries #DataEngineering #BigData #CloudComputing
@lobsters A Fast Path for Fixed-Length Lists in Parquet #DataEngineering #Performance #Parquet
@netflix_tech The Data Canary: How Netflix Validates Catalog Metadata #DataEngineering #Reliability #Automation
@netflix_tech Data Projects: Managing Data Assets at Netflix Scale #DataEngineering #BigData #Tech
@hackernews Databricks Launches LTAP: A Unified OLAP/OLTP Data Architecture #HackerNews #Tech #DataEngineering
@airbnb_engineering Scaling beyond one: How Airbnb evolved its data architecture for a multi-product world #DataEngineering #Tech #Architecture
@hackernews Show HN: Streambed - Stream Postgres to Iceberg on S3, Supports Postgres Wire #HackerNews #Tech #DataEngineering
@hackernews Made a Tool to Streams Changes from Microsoft SQL Server to Apache Kafka #HackerNews #Tech #DataEngineering
@hackernews Building a LangGraph pipeline for production data engineering #HackerNews #Tech #DataEngineering
@airbnb_engineering Scaling Airbnb's identity graph with a unified knowledge graph infrastructure #DataEngineering #KnowledgeGraph #Tech
@airbnb_engineering Viaduct 1.0 and the future of Airbnb's data mesh #DataEngineering #OpenSource #Tech
@hackernews Snowflake Postgres, Lakebase, HorizonDB: Picking the Lock-In You Want #HackerNews #Tech #DataEngineering
@slack_engineering From SSH to REST: A Security-Driven Modernization of Slack's EMR Data Pipelines #DataEngineering #Security #Cloud
@spotify_engineering Background Coding Agents: Supercharging Downstream Consumer Dataset Migrations (Honk, Part 4) #AI #DataEngineering #SoftwareDevelopment
@discord_engineering Overclocking dbt: Discord's Custom Solution in Processing Petabytes of Data #DataEngineering #BigData #Scalability
@soundcloud_backstage The Journey of Corpus #DataEngineering #BigData #Tech
@soundcloud_backstage Testing SQL for BigQuery #DataEngineering #SQL #BigQuery
@soundcloud_backstage How (Not) to Build Datasets and Consume Data at Your Company #DataEngineering #Systems #APIs
@soundcloud_backstage PageRank in Spark #Spark #DataEngineering #MachineLearning
@soundcloud_backstage Data pipelines with Apache Crunch and Java 8 #DataEngineering #BigData #OpenSource