<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Snowflake on Łukasz Prokulski, Dane i Analizy</title><link>https://blog.prokulski.science/tags/snowflake/</link><description>Recent content in Snowflake on Łukasz Prokulski, Dane i Analizy</description><generator>Hugo</generator><language>pl-PL</language><lastBuildDate>Mon, 22 Jun 2026 15:00:00 +0000</lastBuildDate><atom:link href="https://blog.prokulski.science/tags/snowflake/index.xml" rel="self" type="application/rss+xml"/><item><title>Osiem wzorców potoków danych, Snowflake od środka i przedwakacyjny DevOps</title><link>https://blog.prokulski.science/2026/06/22/osiem-wzorcow-potokow-danych-snowflake-od-srodka-i-przedwakacyjny-devops/</link><pubDate>Mon, 22 Jun 2026 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2026/06/22/osiem-wzorcow-potokow-danych-snowflake-od-srodka-i-przedwakacyjny-devops/</guid><description>&lt;p&gt;Rozpoczynamy ostatni tydzień roku szkolnego, co dla wielu oznacza początek letnich urlopów i chwilowe zwolnienie tempa w projektach. To idealny moment na uporządkowanie technicznego długu oraz wdrożenie usprawnień, które pozwolą Twoim systemom bezawaryjnie przetrwać czas wakacyjnej flauty. Warto skupić się na:&lt;/p&gt;&#10;&lt;p&gt;automatyzacji powtarzalnych zadań operacyjnych, przeglądzie konfiguracji bezpieczeństwa i zarządzania kluczami, refaktoryzacji krytycznych fragmentów kodu przed masowymi urlopami w zespole.&lt;/p&gt;&#10;&lt;p&gt;W obszarze inżynierii danych i architektury przyglądamy się sprawdzonym wzorcom projektowym oraz zaawansowanym metodom skalowania przepływów. Zrozumienie relacji między różnymi modelami przetwarzania pozwala na budowanie systemów odpornych na nagłe skoki ruchu. W tym tygodniu dowiesz się więcej o:&lt;/p&gt;</description></item><item><title>Rób produkcyjnie agentów AI, platformy danych i automatyzacje, które naprawdę dowożą</title><link>https://blog.prokulski.science/2026/01/26/rob-produkcyjnie-agentow-ai-platformy-danych-i-automatyzacje-ktore-naprawde-dowoza/</link><pubDate>Mon, 26 Jan 2026 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2026/01/26/rob-produkcyjnie-agentow-ai-platformy-danych-i-automatyzacje-ktore-naprawde-dowoza/</guid><description>&lt;p&gt;To wydanie to mocny pakiet o tym, jak przestać bawić się w „demka” i zacząć budować produkcyjne systemy danych, AI i automatyzacji – od architektury agentów, przez hurtownie, po niskopoziomowe optymalizacje.&lt;/p&gt;&#10;&lt;p&gt;Znajdziesz tu blok tekstów o agentach AI (platformy, orkiestracja, pamięć, narzędzia, realne case’y typu monitoring w Slacku), który pokazuje, co trzeba dostarczyć, żeby agenci nie wybuchli przy pierwszym większym ruchu. Do tego zestaw materiałów o analityce i data engineeringu: dobre EDA, przetwarzanie danych geograficznych z DuckDB + GeoPandas, kontrakty danych, wzorce ETL/ELT (Snowflake + dbt + Airflow, migracja z Airflow do Databricks), patterny pod &lt;em&gt;AI‑ready pipelines&lt;/em&gt; i benchmark DuckDB vs Spark.&lt;/p&gt;</description></item><item><title>Agenci AI, skalowanie pipeline'ów i ewolucja Pythona</title><link>https://blog.prokulski.science/2026/01/19/agenci-ai-skalowanie-pipelineow-i-ewolucja-pythona/</link><pubDate>Mon, 19 Jan 2026 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2026/01/19/agenci-ai-skalowanie-pipelineow-i-ewolucja-pythona/</guid><description>&lt;p&gt;W dzisiejszym wydaniu głęboko zanurzamy się w świat &lt;strong&gt;agentów AI i agentic AI&lt;/strong&gt;: od fundamentalnych rozróżnień między generatywną AI, agentami i podejściem agentycznym, przez praktyczne wyzwania bezpieczeństwa w postaci mapowania API, aż po optymalizację zarządzania kontekstem w Model Context Protocol. Nie zabraknie również solidnych podstaw machine learningu: kodowanie danych kategorycznych, Support Vector Machines oraz kompleksowy przegląd metod detekcji anomalii w Pythonie.&lt;/p&gt;&#10;&lt;p&gt;Na froncie &lt;strong&gt;inżynierii danych&lt;/strong&gt; pokazujemy, jak ewoluować od prostych crontabów do systemów obsługujących miliardy zdarzeń, jak wykorzystać DuckDB do szybkich analiz bez ciężkiej infrastruktury oraz dlaczego dokumentacja jako kod w dbt-checkpoint staje się silnikiem jakości danych. Praktyczny przewodnik end-to-end z darmowymi narzędziami oraz refleksje nad zawodem data engineera dopełniają obrazu codziennych wyzwań w tej dziedzinie.&lt;/p&gt;</description></item><item><title>Sporo "przydasiów" do Linuxa oraz LLMów</title><link>https://blog.prokulski.science/2025/12/01/sporo-przydasiow-do-linuxa-oraz-llmow/</link><pubDate>Mon, 01 Dec 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/12/01/sporo-przydasiow-do-linuxa-oraz-llmow/</guid><description>&lt;p&gt;W dzisiejszym wydaniu skupiamy się na praktycznych aspektach zarządzania danymi i sztuczną inteligencją w środowiskach produkcyjnych. Przedstawiamy kompleksowe podejścia do integracji modeli językowych: orkiestrację wielu LLM za pomocą Spring AI oraz budowę niestandardowych pipeline&amp;rsquo;ów z LangGraph. Znajdziecie również porównanie platform MLOps (MLFlow, Metaflow, Kubeflow).&lt;/p&gt;&#10;&lt;p&gt;W obszarze Big Data i data engineeringu omawiamy kluczowe technologie i wzorce architektoniczne. Delta Lake jako warstwa transakcyjna dla Apache Spark, praktyczne wzorce współpracy zespołowej z DuckDB, dyskusja o przyszłości koncepcji data mesh oraz kompleksowe spojrzenie na ekosystem Big Data – od kolejek wiadomości po HDFS, czyli standardowy stack big data (nota bene - możesz mieć big data w domu - zapraszam do &lt;a href="https://github.com/dane-analizy/big-data-stack"&gt;repo&lt;/a&gt;).&lt;/p&gt;</description></item><item><title>Nowy dział low code</title><link>https://blog.prokulski.science/2025/10/06/nowy-dzial-low-code/</link><pubDate>Mon, 06 Oct 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/10/06/nowy-dzial-low-code/</guid><description>&lt;p&gt;Kolejny tydzień, kolejna porcja wiedzy z szerokiego świata danych i AI. Jak zwasze przed Tobą materiały, które sprawdzą się zarówno w codziennej pracy, jak i przy zgłębianiu nowych technologii.&lt;/p&gt;&#10;&lt;p&gt;Jeśli zajmujesz się infrastrukturą i &lt;strong&gt;DevOps&lt;/strong&gt;, czekają na Ciebie praktyczne wzorce Dockerfile dla Pythona, które zredukują czas buildów do sekund, oraz dziewięć sprawdzonych technik autoskalowania w Kubernetes, które przetrwają piki ruchu. A dla fanów baz danych – przegląd rozszerzeń PostgreSQL, które działają jak supermoc, oraz porównanie architektur Snowflake, Oracle i PostgreSQL.&lt;/p&gt;</description></item><item><title>Sporo Streamlit i tutoriali budowania Agnetów AI</title><link>https://blog.prokulski.science/2025/09/08/sporo-streamlit-i-tutoriali-budowania-agnetow-ai-newsletter-dane-i-analizy--y-m-d/</link><pubDate>Mon, 08 Sep 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/09/08/sporo-streamlit-i-tutoriali-budowania-agnetow-ai-newsletter-dane-i-analizy--y-m-d/</guid><description>&lt;p&gt;Gdy jedni wciąż zastanawiają się, czy warto eksperymentować z agentami AI, inni już budują kompletne systemy analityczne z Pydantic-AI i Streamlit. Gdy niektóre zespoły mierzą się z podstawową konfiguracją Kafki, inne optymalizują przepustowość na poziomie miliona wiadomości na sekundę. Między innymi o tym dzisiaj.&lt;/p&gt;&#10;&lt;p&gt;&lt;strong&gt;Rewolucja agentów AI&lt;/strong&gt; - od zera do działającego agenta z LangGraph, plus praktyczne połączenie Streamlit z Pydantic-AI do analizy danych. To nie są już tylko proof-of-concept, to konkretne narzędzia robocze.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-05-05</title><link>https://blog.prokulski.science/2025/05/05/newsletter-dane-i-analizy-2025-05-05/</link><pubDate>Mon, 05 May 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/05/05/newsletter-dane-i-analizy-2025-05-05/</guid><description>&lt;p&gt;Tym razem, pomimo majówki, zebrałem specjalnie dla Ciebie kolekcję tekstów, które łączy jeden wspólny mianownik - praktyczność. Mniej teorii, więcej konkretów, które możesz zastosować już dziś w swojej pracy z danymi i kodem.&lt;/p&gt;&#10;&lt;p&gt;W świecie AI i ML możesz przyjrzeć się technikom monitorowania sieci neuronowych podczas treningu oraz implementacji autokoderów wariacyjnych z Keras. Oba teksty to solidne przewodniki, które pomogą Ci lepiej zrozumieć, co dzieje się &amp;ldquo;pod maską&amp;rdquo; Twoich modeli.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-05-15</title><link>https://blog.prokulski.science/2023/05/15/newsletter-dane-i-analizy-2023-05-15/</link><pubDate>Mon, 15 May 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/05/15/newsletter-dane-i-analizy-2023-05-15/</guid><description>&lt;p&gt;Wielokrotnie w newsletterze znalazły się teksty mówiące o wykorzystaniu Snowflake, BigQuery czy Databricks. Dzisiaj przyszedł jednak czas na szybkie wprowadzenie do tych narzędzi - jak zacząć z nich korzystać? Jak stworzyć konto, jak załadować pierwsze dane?&lt;/p&gt;&#10;&lt;p&gt;A wiecie, że narzędzia Microsoftu - na przykład Excel (poprzez VBA) czy też PowerBI potrafią współpracować z zewnętrznymi skryptami napisanymi w Pythonie albo R? Jeśli nie, to poniżej znajdziecie przykłady takiej współpracy. Swoją drogą - pewnie już ze dwa lata mija od plotek o wprowadzeniu Pythona do Excela&amp;hellip; ale coś nie widać zmiany.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-10-17</title><link>https://blog.prokulski.science/2022/10/17/newsletter-dane-i-analizy-2022-10-17/</link><pubDate>Mon, 17 Oct 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/10/17/newsletter-dane-i-analizy-2022-10-17/</guid><description>&lt;p&gt;Od ostatniego numeru newslettera przybyło Was trochę - dziękuję za zaufanie i pozostawienie swojego adresu mailowego w nadziei na interesujące materiały. Wiem, że oczekujecie czegoś związanego z Pythonem i przetwarzaniem większej ilości danych, a tym bardziej wiem że dobrze dzisiaj trafiliście.&lt;/p&gt;&#10;&lt;p&gt;Mamy zatem trochę materiału pozwalającego przeskoczyć z poziomu &lt;em&gt;junior&lt;/em&gt; do &lt;em&gt;mid&lt;/em&gt; w Pythonie. Dla tych bardziej zaawansowanych trochę o łączeniu się ze Snowflake z poziomu Pythona (nie tylko dla zainteresowanych Snowflake&amp;rsquo;em te teksty są warte chociażby przejrzenia - dużo w nich wartości między wierszami, czy też liniami kodu).&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-09-26</title><link>https://blog.prokulski.science/2022/09/26/newsletter-dane-i-analizy-2022-09-26/</link><pubDate>Mon, 26 Sep 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/09/26/newsletter-dane-i-analizy-2022-09-26/</guid><description>&lt;p&gt;Wracamy do rysowania wykresów, pobierania danych ze stron internetowych oraz robienia dashboardów (i raportów w Wordzie). To dzisiejsze główne punkty zainteresowań. Ale dla fanów rozwiązań big data też coś się znajdzie.&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="analiza_danych_projekty"&gt;#analiza_danych_projekty&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://blog.platypush.tech/article/Automate-your-music-collection"&gt;&lt;strong&gt;Automate your music collection&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Znudziły Ci się playlisty Spofity? Ciągle słuchasz &amp;ldquo;ulubionych&amp;rdquo;? Być może Ci to odpowiada. Ale jeśli lubisz odkrywać nową muzykę to możesz czuć się jak w bańce. Albo wykorzystać historię odtwarzanych utworów oraz API serwisu Last.fm żeby poznać coś nowego&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-05-02</title><link>https://blog.prokulski.science/2022/05/02/newsletter-dane-i-analizy-2022-05-02/</link><pubDate>Mon, 02 May 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/05/02/newsletter-dane-i-analizy-2022-05-02/</guid><description>&lt;p&gt;Dzisiaj wielkie święto. I nie chodzi o święto flagi, a o nowy post na blogu. Minął prawie rok od poprzedniego, więc dzień ten zasługuje na miano święta ;-)&lt;/p&gt;&#10;&lt;p&gt;Rozproszona architektura, mikroserwisy i baza nosql - taka armata na zwykły sklep internetowy? Tak! Z wyjaśnieniem dlaczego i przykładami w Pythonie! Właśnie to znajdziecie w moim wpisie &lt;a href="../../2022/04/26/sklep-rozproszony/?utm_source=dia_nlt"&gt;&lt;strong&gt;Sklep rozproszony&lt;/strong&gt;&lt;/a&gt;. To zrobiony w kilka dni &lt;em&gt;proof of concept&lt;/em&gt; działania nowoczesnej architektury w dość prostym problemie. Zapraszam do lektury.&lt;/p&gt;</description></item></channel></rss>