<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>MongoDB on Łukasz Prokulski, Dane i Analizy</title><link>https://blog.prokulski.science/tags/mongodb/</link><description>Recent content in MongoDB on Łukasz Prokulski, Dane i Analizy</description><generator>Hugo</generator><language>pl-PL</language><lastBuildDate>Mon, 02 Feb 2026 15:00:00 +0000</lastBuildDate><atom:link href="https://blog.prokulski.science/tags/mongodb/index.xml" rel="self" type="application/rss+xml"/><item><title>Kiedy AI zaczyna tworzyć własną kulturę... i jak ją wdrażać w produkcji</title><link>https://blog.prokulski.science/2026/02/02/kiedy-ai-zaczyna-tworzyc-wlasna-kulture-i-jak-ja-wdrazac-w-produkcji/</link><pubDate>Mon, 02 Feb 2026 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2026/02/02/kiedy-ai-zaczyna-tworzyc-wlasna-kulture-i-jak-ja-wdrazac-w-produkcji/</guid><description>&lt;p&gt;Hit minionego tygodnia - &lt;a href="https://www.moltbook.com/"&gt;Moltbook&lt;/a&gt;. Jest to eksperymentalna sieć społecznościowa w stylu Reddita, zbudowana dla agentów AI, gdzie ludzie mogą tylko podglądać, a nie brać udziału.&lt;/p&gt;&#10;&lt;p&gt;Tekst &lt;a href="https://www.astralcodexten.com/p/best-of-moltbook"&gt;Best Of Moltbook&lt;/a&gt; traktuje Moltbook jako dziwny, ale fascynujący eksperyment: obserwatorium tego, jak zachowują się LLM‑owe agenty, gdy zostawi się je samym sobie z własną przestrzenią społecznościową. Autor waha się między interpretacją &lt;em&gt;to tylko sprytna konfabulacja i echo ludzkich promptów&lt;/em&gt; a podejrzeniem, że dzieje się tu coś ciekawszego - rodzaj zalążkowej kultury agentów, z własnymi memami, lękami, duchowością i polityką.&lt;/p&gt;</description></item><item><title>AI: "jednocześnie dużo mądrzejsze i dużo głupsze, niż się spodziewałem"</title><link>https://blog.prokulski.science/2026/01/05/ai-jednoczesnie-duzo-madrzejsze-i-duzo-glupsze-niz-sie-spodziewalem/</link><pubDate>Mon, 05 Jan 2026 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2026/01/05/ai-jednoczesnie-duzo-madrzejsze-i-duzo-glupsze-niz-sie-spodziewalem/</guid><description>&lt;p&gt;W dzisiejszym wydaniu szeroki przegląd tego, co dzieje się na styku AI, danych i infrastruktury. Zajrzymy pod maskę architektur agentowych, gdzie bazy danych przejmują rolę pamięci długoterminowej i koordynują działanie systemów wieloagentowych. Zobaczymy, jak w praktyce działają autonomiczne pipeline&amp;rsquo;y AI — od generatora pomysłów biznesowych po systemy RAG obsługujące tysiące zapytań na sekundę.&lt;/p&gt;&#10;&lt;p&gt;Nie zabraknie konkretów z obszaru data engineeringu: hybrydowe tabele BigQuery z sekundową świeżością danych, otwarte formaty tabelaryczne (Delta Lake, Iceberg) i nowe możliwości DuckDB — od notebooków w przeglądarce po przetwarzanie terabajtów lokalnie. PostgreSQL również dostaje swoje pięć minut: od wewnętrznych mechanizmów recovery po niedoceniane funkcje, które warto znać.&lt;/p&gt;</description></item><item><title>System design, bazy danych i praktyczny Python</title><link>https://blog.prokulski.science/2025/11/10/system-design-bazy-danych-i-praktyczny-python/</link><pubDate>Mon, 10 Nov 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/11/10/system-design-bazy-danych-i-praktyczny-python/</guid><description>&lt;p&gt;W dzisiejszym wydaniu skupiamy się na praktycznych aspektach projektowania i optymalizacji systemów danych.&lt;br&gt;&#10;Zaczynamy od architektury: poznasz sprawdzone metody nauki projektowania systemów oraz zajrzysz pod maskę infrastruktury OpenAI opartej na Kubernetes i Apache Kafka.&lt;br&gt;&#10;W sekcji baz danych znajdziesz spojrzenie na BigQuery z perspektywy programistów Pythona oraz dwanaście realnych przypadków migracji do DuckDB z konkretnymi oszczędnościami.&lt;/p&gt;&#10;&lt;p&gt;Miłośnicy Pythona znajdą też kilka wartościowych materiałów: od elegancji dekoratorów, przez biblioteki przewyższające Excela, po praktyczną migrację z PostgreSQL do MongoDB. Warto zerknąć na porównanie HTTPX z Requests (nie tylko w kontekście projektów LLM, ale po prostu na httpx jako nowocześniejszy pakiet) oraz omówienie narzędzia UV Toolchain do stabilizacji środowisk CI/CD.&lt;/p&gt;</description></item><item><title>Język polski najlepszy do promptowania?</title><link>https://blog.prokulski.science/2025/10/27/jezyk-polski-najlepszy-do-promptowania/</link><pubDate>Mon, 27 Oct 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/10/27/jezyk-polski-najlepszy-do-promptowania/</guid><description>&lt;p&gt;W dzisiejszym wydaniu dominują tematy związane z infrastrukturą danych i narzędziami AI. Szczególnie polecam artykuł o benchmarku ONERULER – okazuje się, że język polski najlepiej radzi sobie z analizą długich kontekstów w modelach językowych!&lt;/p&gt;&#10;&lt;p&gt;Jeśli budujesz pipeline&amp;rsquo;y danych, znajdziesz praktyczne przewodniki po open table formats (Iceberg, Delta Lake), kompletnej konfiguracji Docker+Airflow+dbt+Postgres oraz wzorcach SQL w DuckDB. Dla zainteresowanych Kafką – materiały o wysokiej dostępności na GKE Autopilot i alternatywie w postaci BufStream z silniejszymi gwarancjami spójności.&lt;/p&gt;</description></item><item><title>Nowy dział low code</title><link>https://blog.prokulski.science/2025/10/06/nowy-dzial-low-code/</link><pubDate>Mon, 06 Oct 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/10/06/nowy-dzial-low-code/</guid><description>&lt;p&gt;Kolejny tydzień, kolejna porcja wiedzy z szerokiego świata danych i AI. Jak zwasze przed Tobą materiały, które sprawdzą się zarówno w codziennej pracy, jak i przy zgłębianiu nowych technologii.&lt;/p&gt;&#10;&lt;p&gt;Jeśli zajmujesz się infrastrukturą i &lt;strong&gt;DevOps&lt;/strong&gt;, czekają na Ciebie praktyczne wzorce Dockerfile dla Pythona, które zredukują czas buildów do sekund, oraz dziewięć sprawdzonych technik autoskalowania w Kubernetes, które przetrwają piki ruchu. A dla fanów baz danych – przegląd rozszerzeń PostgreSQL, które działają jak supermoc, oraz porównanie architektur Snowflake, Oracle i PostgreSQL.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-07-07</title><link>https://blog.prokulski.science/2025/07/07/newsletter-dane-i-analizy-2025-07-07/</link><pubDate>Mon, 07 Jul 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/07/07/newsletter-dane-i-analizy-2025-07-07/</guid><description>&lt;p&gt;Ten tydzień przyniósł szczególnie bogate żniwo materiałów technicznych – po zwyczajowej analizie dziesiątek źródeł i setek (jeśli nie tysięcy) artykułów, udało się wyłonić zwyczajowe &amp;ldquo;około dwadzieścia&amp;rdquo; najważniejszych publikacji z obszaru data science, ML i AI. Rozkład tematyczny doskonale odzwierciedla aktualne trendy w branży (i zainteresowania Redaktora Naczelnego): dominuje Python i Data Engineering. Ale (poza zainteresowaniami Naczelnego) potwierdza to centralną rolę tych obszarów w nowoczesnych zagadnieniach związanych z danymi.&lt;/p&gt;&#10;&lt;p&gt;Szczególnie interesujące są materiały dotyczące architektury systemów AI – od multi-agentowych rozwiązań Anthropic, przez unifikację ML na Ray w Pinterest, aż po praktyczne implementacje MLOps z pełnym monitoringiem. Widać wyraźnie, że branża przechodzi od eksperymentów do produkcyjnych, skalowalnych rozwiązań.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-03-10</title><link>https://blog.prokulski.science/2025/03/10/newsletter-dane-i-analizy-2025-03-10/</link><pubDate>Mon, 10 Mar 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/03/10/newsletter-dane-i-analizy-2025-03-10/</guid><description>&lt;p&gt;Pod koniec lutego &amp;ldquo;ukazał&amp;rdquo; się zbiór danych (pochodzących najprawdopodobniej z serwisu rynekpierwotny.pl) zawierający całkiem sporo ofert nowych mieszkań (i nie tylko). Zbiór o tyle interesujący, że ze współrzędnymi oferowanych lokalizacji. Na &lt;a href="https://www.linkedin.com/feed/update/urn:li:activity:7302029418514857984/"&gt;LinkedIn&lt;/a&gt; wrzuciłem na szybko przygotowaną mapkę wynikającą z tego zbioru, ale planuję coś większego: e-mailowy cykl (3-4 maile, pewnie co tydzień) pokazujący co z tymi danymi można zrobić. Na pewno napiszę o tym w newsletterze, na pewno napiszę o tym na LinkedIn - zatem zapraszam do obserwowania. Na &lt;a href="https://www.facebook.com/DaneAnalizy/"&gt;fanpage&amp;rsquo;u Dane i Analizy&lt;/a&gt; też będzie o tym info, więc też warto obserwować.&lt;br&gt;&#10;Żeby było ciekawiej - dość podobny temat porusza jeden z dzisiejszych postów, jakie znajdziesz poniżej - ten o kebabach - to doskonały przykład praktycznego zastosowania analizy danych.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-10-21</title><link>https://blog.prokulski.science/2024/10/21/newsletter-dane-i-analizy-2024-10-21/</link><pubDate>Mon, 21 Oct 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/10/21/newsletter-dane-i-analizy-2024-10-21/</guid><description>&lt;p&gt;OpenAI ze swoim modelem w wersji o1 wróciło na szczyt listy przebojów w kategorii LLM. Garść firm zajmujących się GenAI zaczyna generować poważne przychody. Co jeszcze dzieje się na rynku AI w 2024 roku? Jaki jest &amp;ldquo;Stan AI w 2024&amp;rdquo;? O tym dowiecie się z raportu, do którego link poniżej, w sekcji AI/ML.&lt;/p&gt;&#10;&lt;p&gt;Sporo w tym wydaniu o bazach danych (co najmniej dwa razy pojawia się Postgres i Redis, ale są też inne rozwiązania: wektorowa &lt;a href="https://milvus.io/"&gt;Milvus&lt;/a&gt;, &lt;a href="https://www.influxdata.com/"&gt;InfluxDB&lt;/a&gt; do szeregów czasowych, grafowa &lt;a href="https://neo4j.com/"&gt;Neo4j&lt;/a&gt;, dobrze znany stałym czytelnikom &lt;a href="https://duckdb.org/"&gt;DuckDB&lt;/a&gt;oraz &lt;a href="https://tile38.com/"&gt;Tile38&lt;/a&gt; do zadań geo).&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-09-23</title><link>https://blog.prokulski.science/2024/09/23/newsletter-dane-i-analizy-2024-09-23/</link><pubDate>Mon, 23 Sep 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/09/23/newsletter-dane-i-analizy-2024-09-23/</guid><description>&lt;p&gt;Dzisiaj nieco później niż zwykle, nieco skromniej i bez zbędnego lania wody. Taki eksperyment.&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="ai_ml"&gt;#ai_ml&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://medium.datadriveninvestor.com/50-handpicked-github-repositories-to-master-data-science-skills-pro-recommended-8231c661e731"&gt;&lt;strong&gt;50 Handpicked GitHub Repositories to Master Data Science Skills&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Najlepszym sposobem na naukę jest praktyka. Własna - pisanie kodu, albo cudza - czytanie kodu. Aby ułatwić to drugie - zbiór materiałów.&lt;/p&gt;&#10;&lt;h3 id="analiza_danych_projekty"&gt;#analiza_danych_projekty&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://itnext.io/feature-engineering-in-xgboost-a-practical-guide-7fbafa7dbdbd"&gt;&lt;strong&gt;Feature Engineering in XGBoost&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Więcej tutaj operacji na danych w Pandasie niż samego XGBoosta, ale o inżynierii cech nigdy za wiele.&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/football-and-geometry-passing-networks-6e201ceff6ef"&gt;&lt;strong&gt;Football and Geometry&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Wprowadzenie do grafów na podstawie siatki podań piłkarzy podczas meczy.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-05-06</title><link>https://blog.prokulski.science/2024/05/06/newsletter-dane-i-analizy-2024-05-06/</link><pubDate>Mon, 06 May 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/05/06/newsletter-dane-i-analizy-2024-05-06/</guid><description>&lt;p&gt;Witamy po majówce. Akumulatory naładowane? Głowy przewietrzone? Karkóweczka zjedzona? :)&lt;br&gt;&#10;Zatem czas na kolejną porcję rozwijających treści.&lt;/p&gt;&#10;&lt;p&gt;Jakoś tak wyszło, że w tym tygodniu mamy kilka zagadnień związanych z Kubernetesem, ale nie odpuszczamy programowania jako takiego (z przewagą Pythona, wiadomo). Poza tym - chyba masz zaległości z poprzedniego numer, prawda?&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="ai_ml"&gt;#ai_ml&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://kai-waehner.medium.com/genai-demo-with-kafka-flink-langchain-and-openai-8c9b7263770a"&gt;&lt;strong&gt;GenAI Demo with Kafka, Flink, LangChain and OpenAI&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Architektura i demo procesu przesyłania danych Kafką i użycia modeli LLM na tychże danych. W treści tekstu znajdziesz też link do nagrania na YT&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-01-22</title><link>https://blog.prokulski.science/2024/01/22/newsletter-dane-i-analizy-2024-01-22/</link><pubDate>Mon, 22 Jan 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/01/22/newsletter-dane-i-analizy-2024-01-22/</guid><description>&lt;p&gt;YOLO. Nie tylko &amp;ldquo;you only live once&amp;rdquo; ale - w kontekście ML/AI i computer vision - przede wszystkim modele do rozpoznawania obiektów na zdjęciach.&lt;br&gt;&#10;Doczekaliśmy się już kilku wersji algorytmu YOLO, każda kolejna jest szybsza, sprawniejsza, rozpoznająca więcej i lepiej. Na to właśnie idzie klikanie w światła drogowe albo autobusy w obrazkowych captcha ;-)&lt;br&gt;&#10;Więcej o kolejnych wersjach YOLO i ich architekturach dowiesz się z &lt;a href="https://learnopencv.com/mastering-all-yolo-models/"&gt;&lt;strong&gt;tekstu&lt;/strong&gt;&lt;/a&gt;, w którym dodatkowo znajdziesz linki do tego jak trenować i używać tych modeli.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-10-30</title><link>https://blog.prokulski.science/2023/10/30/newsletter-dane-i-analizy-2023-10-30/</link><pubDate>Mon, 30 Oct 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/10/30/newsletter-dane-i-analizy-2023-10-30/</guid><description>&lt;p&gt;Dzisiaj trochę o mapkach, trochę o diagramach (takie &lt;em&gt;diagram as a code&lt;/em&gt; tylko dlaczego &lt;a href="https://jira.atlassian.com/browse/BCLOUD-18559"&gt;BitBucket nie potrafi wyświetlić Mermaid&lt;/a&gt; (ticket w Atlassianie jest &amp;ldquo;solved&amp;rdquo;! Ale zobaczcie jak ;-), a GitHub robi to z palcem&amp;hellip; to znaczy bez problemu?), a do tego sporo materiału video. Chyba też więcej niż zwykle treści po polsku (polecamy tekst Tomka Zielińskiego o &lt;em&gt;transportowaniu danych&lt;/em&gt; - może się przydać na spotkania rekrutacyjne, ja lubię zadawać analogiczne pytania).&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-10-09</title><link>https://blog.prokulski.science/2023/10/09/newsletter-dane-i-analizy-2023-10-09/</link><pubDate>Mon, 09 Oct 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/10/09/newsletter-dane-i-analizy-2023-10-09/</guid><description>&lt;p&gt;Dzisiaj w likach znajdziecie ponad pięciogodzinny kurs VSCode (ale nie trzeba oglądać całego - wystarczy z niego wyjąć około 30-45 minut żeby mieć tak zwany komplecik w obrębie swoich zainteresowań). Dodatkowo polecam kurs użycia Postmana - chyba najlepszego narzędzia do współpracy z już gotowym API. Też nie trzeba oglądać całości (tym bardziej że całość to ponad 4 godziny), ale może coś ciekawego znajdziecie? Kurs &lt;a href="https://www.youtube.com/watch?v=zp5Jh2FIpF0"&gt;na YouTube&lt;/a&gt; a kanał &lt;a href="https://www.youtube.com/@freecodecamp"&gt;freeCodeCamp&lt;/a&gt; gorąco polecam! Do newstlettara trafia to co nowe, a masa tam dobrego sprzed lat.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-09-25</title><link>https://blog.prokulski.science/2023/09/25/newsletter-dane-i-analizy-2023-09-25/</link><pubDate>Mon, 25 Sep 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/09/25/newsletter-dane-i-analizy-2023-09-25/</guid><description>&lt;p&gt;W tym tygodniu stawiam na potoki przetwarzające dane i pokazujące je finalnie w jakimś dashboardzie. To najczęstsza robota w korporacjach, szczególnie w zespołach &amp;ldquo;raportowych&amp;rdquo;. Dlatego gorąco polecam dzisiejszy dział &amp;ldquo;Analiza danych - projekty&amp;rdquo;.&lt;/p&gt;&#10;&lt;p&gt;Przy przetwarzaniu danych częstym krokiem jest analiza tego co przychodzi. Można użyć narzędzi BI, można ręcznie rzeźbić kod, a można skorzystać z Data Wranglera - dodatku do VSCode, w którym poszczególne kroki pochodzą z takiego niby wizarda, a w efekcie dostajemy gotowy kod. No trzeba to &lt;a href="https://www.youtube.com/watch?v=KrzcV1c1W1U"&gt;zobaczyć&lt;/a&gt; (10 minut filmu z dość specyficznym akcentem, ale nie takim jak myślicie), a potem można &lt;a href="https://marketplace.visualstudio.com/items?itemName=ms-toolsai.datawrangler"&gt;zainstalować&lt;/a&gt;.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-08-07</title><link>https://blog.prokulski.science/2023/08/07/newsletter-dane-i-analizy-2023-08-07/</link><pubDate>Mon, 07 Aug 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/08/07/newsletter-dane-i-analizy-2023-08-07/</guid><description>&lt;p&gt;Jakie bazy danych są popularne? Które są używane, a których programiści chcieliby użyć w swoim kolejnym projekcie? Między innymi takie pytania zadano w ankiecie &lt;strong&gt;State of Databases 2023&lt;/strong&gt;, której podsumowanie właśnie &lt;a href="https://stateofdb.com/databases"&gt;opublikowano&lt;/a&gt;. Takie ankiety są obrazem rynku - warto śledzić trendy, bo można z nich wywnioskować jakich narzędzi używają inni, w jakie warto inwestować (aby znaleźć pracowników albo pracę). Czy wyniki takich ankiet odpowiadają na pytanie &lt;em&gt;Która technologia jest najlepsza?&lt;/em&gt; - zdecydujcie sami.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-07-17</title><link>https://blog.prokulski.science/2023/07/17/newsletter-dane-i-analizy-2023-07-17/</link><pubDate>Mon, 17 Jul 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/07/17/newsletter-dane-i-analizy-2023-07-17/</guid><description>&lt;p&gt;Gorąco polecam tekst &lt;a href="https://towardsdev.com/data-engineering-project-imdb-movie-analysis-3f79de2f4ce7"&gt;Data Engineering Project: IMDB Movie Analysis&lt;/a&gt; - przykład świetnego projektu pozyskiwania i przetwarzania danych.&lt;/p&gt;&#10;&lt;p&gt;A kiedy dane są już przetworzone - można je pokazać. Wspomniany tekst analizujący dane z IMDB też zawiera ten element, ale dzisiejsze wydanie pokazuje więcej takich przykładów czy też tutoriali. Mamy coś o rysowaniu wykresów (super jest &lt;a href="https://towardsdatascience.com/plotly-and-pandas-combining-forces-for-effective-data-visualization-2e2caad52de9"&gt;Plotly and Pandas: Combining Forces for Effective Data Visualization&lt;/a&gt;) ale też &lt;a href="https://nightingaledvs.com/data-journalism-colour-accessibility/"&gt;o kolorach i ich doborze&lt;/a&gt; do wykresów.&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="ai_ml"&gt;#ai_ml&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://python.plainenglish.io/the-complete-guide-to-keras-loss-functions-776d319e729d"&gt;&lt;strong&gt;The Complete Guide to Keras Loss Functions&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Każdy model uczy się tak, aby dopasować się do metryki, która weryfikuje czy działa on dobrze czy źle. Trzeba więc wiedzieć jak te metryki działają, aby osiągnąć to, czego chcemy. Tutaj znajdziesz informacje o metrykach dostępnych w TF&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-07-10</title><link>https://blog.prokulski.science/2023/07/10/newsletter-dane-i-analizy-2023-07-10/</link><pubDate>Mon, 10 Jul 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/07/10/newsletter-dane-i-analizy-2023-07-10/</guid><description>&lt;p&gt;Myślisz, że analitycy danych już nie będą potrzebni? Dlaczego? Bo pojawił się Code Interpreter, a jeśli nie wiesz o co chodzi to przeczytaj koniecznie o nim (i o tym jak go używać!) &lt;a href="https://www.oneusefulthing.org/p/what-ai-can-do-with-a-toolbox-getting"&gt;tutaj (&amp;ldquo;What AI can do with a toolbox&amp;hellip; Getting started with Code Interpreter&amp;rdquo;)&lt;/a&gt; oraz &lt;a href="https://www.oneusefulthing.org/p/it-is-starting-to-get-strange"&gt;tutaj (&amp;ldquo;It is starting to get strange&amp;rdquo;)&lt;/a&gt;. Code Interpreter jest dostępny w planie &amp;ldquo;ChatGPT Plus&amp;rdquo;.&lt;/p&gt;&#10;&lt;p&gt;I ten temat, te dwa teksty to chyba najciekawszy materiał w tym tygodniu. Gdyby było mało - poniżej kilka kolejnych.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-06-26</title><link>https://blog.prokulski.science/2023/06/26/newsletter-dane-i-analizy-2023-06-26/</link><pubDate>Mon, 26 Jun 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/06/26/newsletter-dane-i-analizy-2023-06-26/</guid><description>&lt;p&gt;Rozpoczynamy pierwszy tydzień wakacji, ale to wcale nie oznacza, że newsletter ma urlop. Wręcz przeciwnie.&lt;/p&gt;&#10;&lt;p&gt;W dzisiejszym wydaniu kilka tekstów opisujących dobre praktyki i całe cykle tutorialowe: CRUD-woe API dla MongoDB czy też asynchroniczne mikroserwisy spięte Rabbitem. To dla tych średniozaawansowanych programistów (i tych, którzy chcą swoją wiedzę przenieść z poziomu juniorskiego na wyższy). Dla tych bardziej juniorów - korepetycje z Window Functions w SQLu i &amp;ldquo;rozpakowywujących&amp;rdquo; gwiazdek w Pythonie (mimo że to nie Gwiazdka, he he, zacny suchar).&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-01-23</title><link>https://blog.prokulski.science/2023/01/23/newsletter-dane-i-analizy-2023-01-23/</link><pubDate>Mon, 23 Jan 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/01/23/newsletter-dane-i-analizy-2023-01-23/</guid><description>&lt;p&gt;Dzisiaj sporo materiałów edukacyjnych, konkretnych przykładów i rozwiązań (przynajmniej takie mam nadzieję, że tak zostaną przez Was odebrane).&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://cuvalley.com/?utm_source=dia_newsletter&amp;amp;utm_medium=email&amp;amp;utm_campaign=dane_i_analizy"&gt;&lt;img src="https://prokulski.science/temp/static/nlt/cuvalley_2023.jpg" alt=""&gt;&lt;/a&gt;&lt;/p&gt;&#10;&lt;p&gt;Przypominam, że &lt;a href="https://cuvalley.com/?utm_source=dia_newsletter&amp;amp;utm_medium=email&amp;amp;utm_campaign=dane_i_analizy"&gt;&lt;strong&gt;CuValley Hack&lt;/strong&gt;&lt;/a&gt;, hackathon organizowany przez #KGHM, startuje już w tym tygodniu - 27.01!&lt;/p&gt;&#10;&lt;p&gt;Co Was czeka: 4 zadania i 127 500 PLN do wygrania! 40h kodowania analiza danych, #AI, #MachineLearning, #BigData webinary, Keynote Speakerzy i duża dawka wiedzy&lt;/p&gt;&#10;&lt;p&gt;Szczegóły (na przykład zadania) i darmowa rejestracja na stronie &lt;a href="https://cuvalley.com/?utm_source=dia_newsletter&amp;amp;utm_medium=email&amp;amp;utm_campaign=dane_i_analizy"&gt;&lt;strong&gt;www.cuvalley.com&lt;/strong&gt;&lt;/a&gt;&lt;/p&gt;&#10;&lt;p&gt;Dane i Analizy to patron społecznościowy, a ten konkretny konkurs to spełnienie mojej idei hackathonu: dane z przemysłu i rozwiązania dla przemysłu.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-09-26</title><link>https://blog.prokulski.science/2022/09/26/newsletter-dane-i-analizy-2022-09-26/</link><pubDate>Mon, 26 Sep 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/09/26/newsletter-dane-i-analizy-2022-09-26/</guid><description>&lt;p&gt;Wracamy do rysowania wykresów, pobierania danych ze stron internetowych oraz robienia dashboardów (i raportów w Wordzie). To dzisiejsze główne punkty zainteresowań. Ale dla fanów rozwiązań big data też coś się znajdzie.&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="analiza_danych_projekty"&gt;#analiza_danych_projekty&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://blog.platypush.tech/article/Automate-your-music-collection"&gt;&lt;strong&gt;Automate your music collection&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Znudziły Ci się playlisty Spofity? Ciągle słuchasz &amp;ldquo;ulubionych&amp;rdquo;? Być może Ci to odpowiada. Ale jeśli lubisz odkrywać nową muzykę to możesz czuć się jak w bańce. Albo wykorzystać historię odtwarzanych utworów oraz API serwisu Last.fm żeby poznać coś nowego&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-09-05</title><link>https://blog.prokulski.science/2022/09/05/newsletter-dane-i-analizy-2022-09-05/</link><pubDate>Mon, 05 Sep 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/09/05/newsletter-dane-i-analizy-2022-09-05/</guid><description>&lt;p&gt;Pod logiem Fundacji Apache aż roi się od projektów, a świat big data to pewnie w 90-95% Apache COŚ. Znamy Kafkę, znamy Apache Spark, Apache Hadoop. Dzisiaj przedstawiamy (w dziale BigData) kilkoro innych członków rodziny.&lt;/p&gt;&#10;&lt;p&gt;Jeśli zaś mamy dużo mapek do wyświetlenia naszym klientom na stronie (bo na przykład monitorujemy każdy wypożyczony rower, hulajnogę czy samochód i mamy miliony wejść na stronę dziennie) to w dziale DevOps coś o rozwiązaniu open soruce, które może zmniejszyć nasze koszty.&lt;/p&gt;</description></item><item><title>Sklep rozproszony</title><link>https://blog.prokulski.science/2022/04/26/sklep-rozproszony/</link><pubDate>Tue, 26 Apr 2022 12:52:17 +0000</pubDate><guid>https://blog.prokulski.science/2022/04/26/sklep-rozproszony/</guid><description>&lt;p&gt;Od kilku lat zajmuję się przede wszystkim wymyślaniem &lt;em&gt;jak coś ma działać&lt;/em&gt;, opisywaniem tego i oddawaniem do zespołu developerskiego. Głównie są to rzeczy związane z real-time’owym działaniem systemów wszelakich. I dzisiaj przykład takiego działania. Dodatkowo - próbowałem napisać kod tak, żeby był łatwy do rozbudowy.&lt;/p&gt;&#10;&lt;h2 id="o-co-chodzi"&gt;O co chodzi?&lt;/h2&gt;&#10;&lt;p&gt;Zbudujemy coś na kształt prostego sklepu internetowego. Całość będzie zbudowana w nowoczesny (a przynajmniej tak się mówi na konferencjach, a jest to właściwie &lt;em&gt;jedyny słuszny&lt;/em&gt;) sposób, komponenty będą od siebie niezależne, a kod w zamyśle ma wspierać taką niezależność.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-04-11</title><link>https://blog.prokulski.science/2022/04/11/newsletter-dane-i-analizy-2022-04-11/</link><pubDate>Mon, 11 Apr 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/04/11/newsletter-dane-i-analizy-2022-04-11/</guid><description>&lt;p&gt;Trochę mniej artykułów, ale jeden z nich to potężny kolos (ten o SHAP). Do tego bardzo fajne porady dla początkujących w Pythonie i ciekawe koncepcje w świecie big data (jakby ktoś chciał postawić klaster to jest o tym poradnik).&lt;/p&gt;&#10;&lt;p&gt;Zaś w przyszłym tygodniu zrobimy sobie przerwę świąteczną - polewajcie się wodą za tydzień (oby pogoda dopisała), a nie zajmujcie się komputerami. Wesołych Świąt!&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="analiza_danych_koncepcje"&gt;#analiza_danych_koncepcje&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/revisiting-mnist-with-fresh-eyes-36f9d19a75d1"&gt;&lt;strong&gt;Revisiting MNIST with Fresh Eyes&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Każdy kto próbował machine learningu albo deep learningu (w szczególności sieci CNN) zetknął się ze zbiorem ręcznie pisanych cyfr MNIST. Tutaj inne podejście do znanego problemu&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-06-21</title><link>https://blog.prokulski.science/2021/06/21/newsletter-dane-i-analizy-2021-06-21/</link><pubDate>Mon, 21 Jun 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/06/21/newsletter-dane-i-analizy-2021-06-21/</guid><description>&lt;p&gt;&lt;a href="https://jellyfish.tech/implementation-of-common-design-patterns-in-python/"&gt;&lt;strong&gt;Implementation of Top Design Patterns in Python&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;*according to developer &amp;amp; software architect with 9+ years of experience&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/a-hands-on-demo-of-analyzing-big-data-with-spark-68cb6600a295?source=rss----7f60cf5620c9---4"&gt;&lt;strong&gt;A hands-on demo of analyzing big data with Spark&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Scan a novel, calculate pi, and run regression on 50 million rows Conclusions This post was a deep dive on using Spark to process big data. We started with an overview of distributed computing before counting the frequency of each letter in Dostoyevsky’s War and Peace , estimating π with randomly (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-06-14</title><link>https://blog.prokulski.science/2021/06/14/newsletter-dane-i-analizy-2021-06-14/</link><pubDate>Mon, 14 Jun 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/06/14/newsletter-dane-i-analizy-2021-06-14/</guid><description>&lt;p&gt;&lt;a href="https://chollinger.com/blog/2021/04/raspberry-pi-gardening-monitoring-a-vegetable-garden-using-a-raspberry-pi-part-1/"&gt;&lt;strong&gt;Raspberry Pi Gardening: Monitoring a Vegetable Garden using a Raspberry Pi - Part 1&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;On how growing vegetables is more complicated how it looks, why bad soldering still works, on moving individual bits around, and what I learned about using technology where one probably does not need technology.&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/air-piano-using-opencv-and-python-298cb22097d9?source=rss----7f60cf5620c9---4"&gt;&lt;strong&gt;Air Piano using OpenCV and Python&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Play the piano by just moving your fingers in the air! Taken from Unsplash My inspiration to make an “Air Piano” Recently I visited my cousin and she had been trying to learn piano for quite some time. However, due to the pandemic, her teacher could not come home and they were practising through (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-05-03</title><link>https://blog.prokulski.science/2021/05/03/newsletter-dane-i-analizy-2021-05-03/</link><pubDate>Mon, 03 May 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/05/03/newsletter-dane-i-analizy-2021-05-03/</guid><description>&lt;p&gt;&lt;a href="https://www.enterprisedb.com/blog/comparison-joins-mongodb-vs-postgresql"&gt;&lt;strong&gt;Comparison of JOINS: MongoDB vs. PostgreSQL | EDB&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;This is the second in a continuing series comparing MongoDB capabilities with those of Postgres. The first post covered “Schema Later Considered Harmful.”&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/using-machine-learning-to-predict-customers-next-purchase-day-7895ad49b4db"&gt;&lt;strong&gt;Using Machine Learning to Predict Customers Next Purchase Day&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Machine Learning model to predict whether customers will make their next purchase after a certain period. Image by Mediamodifier and can be accessed  here . Introduction If there is one major lesson that those in the retail business have learnt from the SARS-CoV-2 pandemic, it is the demand to (&amp;hellip;)&lt;/p&gt;</description></item></channel></rss>