<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Analiza Danych on Łukasz Prokulski, Dane i Analizy</title><link>https://blog.prokulski.science/tags/analiza-danych/</link><description>Recent content in Analiza Danych on Łukasz Prokulski, Dane i Analizy</description><generator>Hugo</generator><language>pl-PL</language><lastBuildDate>Mon, 23 Mar 2026 15:00:00 +0000</lastBuildDate><atom:link href="https://blog.prokulski.science/tags/analiza-danych/index.xml" rel="self" type="application/rss+xml"/><item><title>Agenty piszą kod, ale nie projektują systemów. Plus ponad 20 innych materiałów</title><link>https://blog.prokulski.science/2026/03/23/agenty-pisza-kod-ale-nie-projektuja-systemow-plus-ponad-20-innych-materialow/</link><pubDate>Mon, 23 Mar 2026 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2026/03/23/agenty-pisza-kod-ale-nie-projektuja-systemow-plus-ponad-20-innych-materialow/</guid><description>&lt;p&gt;W dzisiejszym wydaniu dominują dwa tematy: agenty AI i granice tego, co faktycznie potrafią, oraz architektura systemów na konkretnych przykładach z produkcji.&lt;/p&gt;&#10;&lt;p&gt;Znajdziesz tu też case study Slacka (przebudowa powiadomień), Twittera (500 tys. tweetów na minutę) i Stripe&amp;rsquo;a (1300 PR-ów tygodniowo), a obok nich – praktyczne materiały o DuckDB, dbt, LangGraph i ClickHouse.&lt;/p&gt;&#10;&lt;p&gt;Osobny wątek to praca z modelami językowymi: od kursów Anthropic, przez projektowanie system promptów, po refleksję o tym, dlaczego zaczynamy przepraszać chatboty.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-06-02</title><link>https://blog.prokulski.science/2025/06/02/newsletter-dane-i-analizy-2025-06-02/</link><pubDate>Mon, 02 Jun 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/06/02/newsletter-dane-i-analizy-2025-06-02/</guid><description>&lt;p&gt;Ten tydzień przyniósł interesującą mieszankę praktycznych rozwiązań i technologicznych rewolucji. Od monitorowania nocnych maratonów chomików (to ta rewolucja, wiadomo) po architekturę Apache Spark - branża pokazuje, że innowacja kryje się w każdym zakątku.&lt;/p&gt;&#10;&lt;p&gt;Szczególnie ciekawy jest trend odchodzenia od tradycyjnych rozwiązań na rzecz nowoczesnych alternatyw. Na przykład zamiast odpalać joby w cronie można wykorzystać Change Data Capture (CDC), a API-first podejście staje się standardem dla 74% zespołów. Apache Iceberg wygra wojnę formatów tabel, a FastAPI udowadnia, że Python może być równie wydajny co elegancki.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-01-13</title><link>https://blog.prokulski.science/2025/01/13/newsletter-dane-i-analizy-2025-01-13/</link><pubDate>Mon, 13 Jan 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/01/13/newsletter-dane-i-analizy-2025-01-13/</guid><description>&lt;p&gt;Mam dla Ciebie nową porcję ciekawych tekstów, artykułów, zestawień i tutoriali – jak zwykle trochę o Pythonie, trochę o analizie danych, no i oczywiście coś o AI i ML. Ale spokojnie, nie wszystko tutaj to programowanie (chociaż wiadomo, że to nasz główny temat :). Znajdziesz tu materiały dla każdego: od tych, którzy dopiero zaczynają, po treści dla bardziej zaawansowanych.&lt;br&gt;&#10;Oto, co między innymi znajdziesz dzisiaj poniżej:&lt;/p&gt;&#10;&lt;p&gt;&lt;strong&gt;Sztuczna inteligencja i uczenie maszynowe&lt;/strong&gt; – rozpocznij rok od 50 najważniejszych materiałów o AI w 2025 roku, dowiedz się, jak zoptymalizować modele takie jak YOLOv8 na małych urządzeniach, i poznaj sposób na tworzenie asystentów AI do analizy rynków surowcowych. A może zainspiruje Cię budowa medycznego chatbota lub wykorzystanie MLFlow w agnostycznym podejściu do zarządzania modelami? &lt;strong&gt;Analiza danych i inżynieria danych&lt;/strong&gt; – zanurz się w zaawansowanych technikach SQL dla niestrukturalnych danych, poznaj tajniki przetwarzania strumieniowego z użyciem Apache Spark, Kafka i Airflow, a także odkryj różnice między Elasticsearch a Apache Doris w analizie danych w czasie rzeczywistym. &lt;strong&gt;Python w praktyce&lt;/strong&gt; – dowiedz się, jak stworzyć system powiadomień z FastAPI, pracować z danymi przestrzennymi za pomocą GeoAlchemy, czy automatycznie generować diagramy architektury z kodu. Tu mała zapowiedź (bo jak się powie publicznie to ciąży taka motywacja &amp;ldquo;przecież obiecałem&amp;rdquo;), niejako przy okazji. Szykuję ebooka, który poprowadzi Cię krok po kroku przez projekt budowy aplikacji w Pythonie. Co więcej, w ebooku zajmiemy się naprawdę praktycznymi zadaniami, które odciążają od nudnej pracy. Wspólnie stworzymy dwie aplikacje, ucząc się po drodze, jak wykorzystywać usługi sieciowe, jak działać z bazami danych, i jak efektywnie wyświetlać zapisane dane. A żeby było co wyświetlać – sami stworzymy bazę danych, do której będziemy dodawać informacje! Ciekawe? Więcej szczegółów być może już za tydzień. Wypatruj! &lt;strong&gt;Bezpieczeństwo i ciekawostki&lt;/strong&gt; – przeanalizuj globalne statystyki dotyczące otwartego portu 80, odkryj sposoby, w jakie Uber oszczędza czas dzięki Text-to-SQL, i sprawdź, jak korzystać z YouTube prosto z terminala. Inne inspiracje – od katalogów danych i ich obserwowalności po trendy marketingowe według TikToka – każdy znajdzie coś dla siebie.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-01-06</title><link>https://blog.prokulski.science/2025/01/06/newsletter-dane-i-analizy-2025-01-06/</link><pubDate>Mon, 06 Jan 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/01/06/newsletter-dane-i-analizy-2025-01-06/</guid><description>&lt;p&gt;W dniu, gdy tradycyjnie Trzej Mędrcy dotarli do celu swojej podróży kierując się gwiazdą, ja przybywam z kolekcją wartościowych znalezisk ze świata Pythona i analizy danych. Mędrcy przynieśli złoto, kadzidło i mirrę - dzisiejsze wydanie niesie pakiet różnorodnych artykułów, które (mam nadzieję) okażą się równie cennymi darami dla Twojego rozwoju zawodowego.&lt;/p&gt;&#10;&lt;p&gt;W tym wydaniu znajdziesz standardowo kilka praktycznych materiałów z zakresu data science: od budowania systemu tradingowego opartego na średniej kroczącej, przez analizę szeregów czasowych, aż po wykorzystanie biblioteki statsmodels.&lt;br&gt;&#10;Dla osób zainteresowanych automatyzacją wdrożeń (i nie tylko) mamy podstawową dawkę wiedzy o GitHub Actions i skryptach bashowych, a na koniec dość klasyczna integracja FastAPI z Reactem.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-04-29</title><link>https://blog.prokulski.science/2024/04/29/newsletter-dane-i-analizy-2024-04-29/</link><pubDate>Mon, 29 Apr 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/04/29/newsletter-dane-i-analizy-2024-04-29/</guid><description>&lt;hr&gt;&#10;&lt;h3 id="ai_ml"&gt;#ai_ml&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://www.analyticsvidhya.com/blog/2024/04/how-to-run-llama-3-locally/"&gt;&lt;strong&gt;How to Run Llama 3 Locally?&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;W zeszłym tygodniu nie było nic o Llama 3, zatem dzisiaj instrukcja jak ten najnowszy model językowy od Facebooka uruchomić lokalnie.&lt;/p&gt;&#10;&lt;h3 id="analiza_danych_koncepcje"&gt;#analiza_danych_koncepcje&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://nobledynamic.com/posts/fabric-madness-4/"&gt;&lt;strong&gt;Fabric Madness: Experiments&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Eksperymenty z MLFlow spięte z MS Fabric&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://www.openriskmanagement.com/representing-matrices-as-json-objects-part-1/"&gt;&lt;strong&gt;Representing Matrices as JSON Objects&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Czy macierz można zapisać w JSONie? Pierwszy z serii artykułów na temat kompromisów pomiędzy macierzami a tym formatem plików&lt;/p&gt;&#10;&lt;h3 id="analiza_danych_projekty"&gt;#analiza_danych_projekty&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/public-transport-accessibility-in-python-dbdeee99f36f"&gt;&lt;strong&gt;Public Transport Accessibility in Python&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Analiza danych geograficznych w Pythonie - dostępność komunikacji miejskiej w Budapeszcie. Ale może to być dostępność do restauracji, aptek czy paczkomatów&amp;hellip;&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-04-15</title><link>https://blog.prokulski.science/2024/04/15/newsletter-dane-i-analizy-2024-04-15/</link><pubDate>Mon, 15 Apr 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/04/15/newsletter-dane-i-analizy-2024-04-15/</guid><description>&lt;hr&gt;&#10;&lt;h3 id="analiza_danych_projekty"&gt;#analiza_danych_projekty&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://medium.com/data-and-beyond/mastering-exploratory-data-analysis-eda-everything-you-need-to-know-7e3b48d63a95"&gt;&lt;strong&gt;Mastering Exploratory Data Analysis (EDA)&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Usystematyzowane podejście do analizy danych, której celem jest odkrycie istotnych dla przyszłych modeli cech. Za każdym razem robi się to podobnie, więc - warto znać zasady.&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/improving-generalization-in-survival-models-bb7bc045bfc6"&gt;&lt;strong&gt;Improving Generalization in Survival Models&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Analiza przeżycia jako sposób na predykcję odejść pracowników.&lt;/p&gt;&#10;&lt;h3 id="architektura"&gt;#architektura&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://www.youtube.com/watch?v=qcJASFx-F5g"&gt;&lt;strong&gt;So You Want to Build An Event Driven System?&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Jak zbudować system sterowany zdarzeniami? Jakie są korzyści z przyjęcia tego stylu architektury, jakie są wyzwania i niektóre kompromisy? Nagranie z konferencji [YouTube, 52 minuty, po angielsku]&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-02-26</title><link>https://blog.prokulski.science/2024/02/26/newsletter-dane-i-analizy-2024-02-26/</link><pubDate>Mon, 26 Feb 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/02/26/newsletter-dane-i-analizy-2024-02-26/</guid><description>&lt;p&gt;Skupiamy się w tym tygodniu na zagadnieniach związanych z budowaniem rozwiązań skonteneryzowanych. Mamy więc coś o Dockerze i pakowaniu do niego naszych aplikacji (napisanych w różnych językach, żeby było &amp;ldquo;dla każdego coś miłego&amp;rdquo;), coś (może nieco więcej niż &amp;ldquo;coś&amp;rdquo;) o Kubernetesie - bo to kolejny krok, a wydaje się to być nieco zakręcone. Do tego garść tricków i porad związanych z tymi zagadnieniami, chociażby o nieznanych (albo raczej: nie używanych) opcjach Gita. Ale to dla prawdziwych wyjadaczy.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-11-06</title><link>https://blog.prokulski.science/2023/11/06/newsletter-dane-i-analizy-2023-11-06/</link><pubDate>Mon, 06 Nov 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/11/06/newsletter-dane-i-analizy-2023-11-06/</guid><description>&lt;p&gt;Odcinek przeprowadzkowy, gdyż miniony tydzień (a nawet dwa) to jedno wielkie urwanie głowy. Cały tydzień minął mi pod hasłem &amp;ldquo;przeprowadzka&amp;rdquo;, a to jak pewnie możecie się domyślać czas spędzony na pakowaniu, na rozpakowywaniu i (co najgorsze dla &lt;em&gt;pracownika umysłowego&lt;/em&gt; ;-) noszeniu paczek. Szczerze mówiąc jakieś 20, może 30 procent rzeczy trafiło do utylizacji. A niby człowiek sprząta i pozbywa się na bieżąco.&lt;/p&gt;&#10;&lt;p&gt;Ale nie poddajemy się i życie trwa, newsletter wychodzi, a żona dała radę też nagrać &lt;a href="https://youtu.be/xNxulbY0xk8?si=K5Dd276tVY1URzMC"&gt;odcinek swojego programu o książkach&lt;/a&gt; (już z pustego mieszkania). Jeśli interesuje Was literatura to serdecznie polecam &lt;a href="https://www.youtube.com/@ZnalezionePrzeczytane"&gt;&lt;strong&gt;Znalezione przeczytane&lt;/strong&gt;&lt;/a&gt;.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-09-25</title><link>https://blog.prokulski.science/2023/09/25/newsletter-dane-i-analizy-2023-09-25/</link><pubDate>Mon, 25 Sep 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/09/25/newsletter-dane-i-analizy-2023-09-25/</guid><description>&lt;p&gt;W tym tygodniu stawiam na potoki przetwarzające dane i pokazujące je finalnie w jakimś dashboardzie. To najczęstsza robota w korporacjach, szczególnie w zespołach &amp;ldquo;raportowych&amp;rdquo;. Dlatego gorąco polecam dzisiejszy dział &amp;ldquo;Analiza danych - projekty&amp;rdquo;.&lt;/p&gt;&#10;&lt;p&gt;Przy przetwarzaniu danych częstym krokiem jest analiza tego co przychodzi. Można użyć narzędzi BI, można ręcznie rzeźbić kod, a można skorzystać z Data Wranglera - dodatku do VSCode, w którym poszczególne kroki pochodzą z takiego niby wizarda, a w efekcie dostajemy gotowy kod. No trzeba to &lt;a href="https://www.youtube.com/watch?v=KrzcV1c1W1U"&gt;zobaczyć&lt;/a&gt; (10 minut filmu z dość specyficznym akcentem, ale nie takim jak myślicie), a potem można &lt;a href="https://marketplace.visualstudio.com/items?itemName=ms-toolsai.datawrangler"&gt;zainstalować&lt;/a&gt;.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-08-07</title><link>https://blog.prokulski.science/2023/08/07/newsletter-dane-i-analizy-2023-08-07/</link><pubDate>Mon, 07 Aug 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/08/07/newsletter-dane-i-analizy-2023-08-07/</guid><description>&lt;p&gt;Jakie bazy danych są popularne? Które są używane, a których programiści chcieliby użyć w swoim kolejnym projekcie? Między innymi takie pytania zadano w ankiecie &lt;strong&gt;State of Databases 2023&lt;/strong&gt;, której podsumowanie właśnie &lt;a href="https://stateofdb.com/databases"&gt;opublikowano&lt;/a&gt;. Takie ankiety są obrazem rynku - warto śledzić trendy, bo można z nich wywnioskować jakich narzędzi używają inni, w jakie warto inwestować (aby znaleźć pracowników albo pracę). Czy wyniki takich ankiet odpowiadają na pytanie &lt;em&gt;Która technologia jest najlepsza?&lt;/em&gt; - zdecydujcie sami.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-06-05</title><link>https://blog.prokulski.science/2023/06/05/newsletter-dane-i-analizy-2023-06-05/</link><pubDate>Mon, 05 Jun 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/06/05/newsletter-dane-i-analizy-2023-06-05/</guid><description>&lt;p&gt;Czy ChatGPT może nauczyć Cię data science? Czy czas mentorów się kończy?&lt;/p&gt;&#10;&lt;p&gt;Raczej nie &amp;ldquo;włoży&amp;rdquo; do Twojej głowy wiedzy, ale może pokazać kierunki, w których warto podążać w poszukiwaniu kolejnych elementów wiedzy. Może też odpowiedzieć na pytania, podać gotowe rozwiązania (chociażby w postaci fragmentów kodu). O tym mówi &lt;a href="https://pub.towardsai.net/supercharge-your-skills-with-chatgpt-to-get-a-head-99-of-data-scientist-b03a566d4ad#8338"&gt;ten tekst&lt;/a&gt;.&lt;/p&gt;&#10;&lt;p&gt;Ale czy to, że mamy takie narzędzia dostępne na wyciągnięcie ręki sprawi, że staniemy się mądrzejsi? Dzisiaj dział ChatGPT dość obfity - chyba uczymy się powoli wykorzystywać to narzędzie w różnych zastosowaniach, po prostu w swojej pracy.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-05-29</title><link>https://blog.prokulski.science/2023/05/29/newsletter-dane-i-analizy-2023-05-29/</link><pubDate>Mon, 29 May 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/05/29/newsletter-dane-i-analizy-2023-05-29/</guid><description>&lt;p&gt;Dość przekrojowo dzisiaj.&lt;/p&gt;&#10;&lt;p&gt;Najciekasze według mnie tekstu to ten o sensownym nadawaniu gwiazdek produktom (ile razy filtrowaliście produkty w sklepie internetowym przed kupnem po najlepszej ocenie i okazywało się, że z &amp;ldquo;piątką&amp;rdquo; jest tylko jeden?), ten o SoftMax (nie przeraź się równaniami na początku, chociaż może podstawy matematyczne są akutat dla Ciebie cenne?).&lt;/p&gt;&#10;&lt;p&gt;Bardzo dajny jest też dział Python - od rzeczy prostych typu wiele wykresów na jednym obrazku do modelu (no&amp;hellip;) informującego o tym że akcje należy kupić albo sprzedać.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-01-23</title><link>https://blog.prokulski.science/2023/01/23/newsletter-dane-i-analizy-2023-01-23/</link><pubDate>Mon, 23 Jan 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/01/23/newsletter-dane-i-analizy-2023-01-23/</guid><description>&lt;p&gt;Dzisiaj sporo materiałów edukacyjnych, konkretnych przykładów i rozwiązań (przynajmniej takie mam nadzieję, że tak zostaną przez Was odebrane).&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://cuvalley.com/?utm_source=dia_newsletter&amp;amp;utm_medium=email&amp;amp;utm_campaign=dane_i_analizy"&gt;&lt;img src="https://prokulski.science/temp/static/nlt/cuvalley_2023.jpg" alt=""&gt;&lt;/a&gt;&lt;/p&gt;&#10;&lt;p&gt;Przypominam, że &lt;a href="https://cuvalley.com/?utm_source=dia_newsletter&amp;amp;utm_medium=email&amp;amp;utm_campaign=dane_i_analizy"&gt;&lt;strong&gt;CuValley Hack&lt;/strong&gt;&lt;/a&gt;, hackathon organizowany przez #KGHM, startuje już w tym tygodniu - 27.01!&lt;/p&gt;&#10;&lt;p&gt;Co Was czeka: 4 zadania i 127 500 PLN do wygrania! 40h kodowania analiza danych, #AI, #MachineLearning, #BigData webinary, Keynote Speakerzy i duża dawka wiedzy&lt;/p&gt;&#10;&lt;p&gt;Szczegóły (na przykład zadania) i darmowa rejestracja na stronie &lt;a href="https://cuvalley.com/?utm_source=dia_newsletter&amp;amp;utm_medium=email&amp;amp;utm_campaign=dane_i_analizy"&gt;&lt;strong&gt;www.cuvalley.com&lt;/strong&gt;&lt;/a&gt;&lt;/p&gt;&#10;&lt;p&gt;Dane i Analizy to patron społecznościowy, a ten konkretny konkurs to spełnienie mojej idei hackathonu: dane z przemysłu i rozwiązania dla przemysłu.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-05-09</title><link>https://blog.prokulski.science/2022/05/09/newsletter-dane-i-analizy-2022-05-09/</link><pubDate>Mon, 09 May 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/05/09/newsletter-dane-i-analizy-2022-05-09/</guid><description>&lt;p&gt;Dzisiaj mamy fajną paczkę tekstów o hiperparametrach, skalowaniu cech i innych rzeczach związanych z uczeniem maszynowym i &lt;em&gt;podkręcaniem&lt;/em&gt; modeli. Tradycyjnie też kształcimy i rozwijamy się nieco w Pythonie.&lt;/p&gt;&#10;&lt;p&gt;W bardziej zaawansowanych tematach coś, czym firma &lt;a href="https://prokulski.science/"&gt;Dane i Analizy&lt;/a&gt; zajmuje się na co dzień: inżynieria danych, przepływy głównie z wykorzystaniem Apache Kafka czy też projektowanie architektury zbliżonej do tej którą wykorzystuje Airbnb.&lt;/p&gt;&#10;&lt;p&gt;Polecam też nową inicjatywę Krzysztofa Sopyły - Podcast Biznes AI. Zapowiada się dobrze, powodzenia Krzysiek!&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-05-02</title><link>https://blog.prokulski.science/2022/05/02/newsletter-dane-i-analizy-2022-05-02/</link><pubDate>Mon, 02 May 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/05/02/newsletter-dane-i-analizy-2022-05-02/</guid><description>&lt;p&gt;Dzisiaj wielkie święto. I nie chodzi o święto flagi, a o nowy post na blogu. Minął prawie rok od poprzedniego, więc dzień ten zasługuje na miano święta ;-)&lt;/p&gt;&#10;&lt;p&gt;Rozproszona architektura, mikroserwisy i baza nosql - taka armata na zwykły sklep internetowy? Tak! Z wyjaśnieniem dlaczego i przykładami w Pythonie! Właśnie to znajdziecie w moim wpisie &lt;a href="../../2022/04/26/sklep-rozproszony/?utm_source=dia_nlt"&gt;&lt;strong&gt;Sklep rozproszony&lt;/strong&gt;&lt;/a&gt;. To zrobiony w kilka dni &lt;em&gt;proof of concept&lt;/em&gt; działania nowoczesnej architektury w dość prostym problemie. Zapraszam do lektury.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-04-25</title><link>https://blog.prokulski.science/2022/04/25/newsletter-dane-i-analizy-2022-04-25/</link><pubDate>Mon, 25 Apr 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/04/25/newsletter-dane-i-analizy-2022-04-25/</guid><description>&lt;p&gt;Dzisiaj zapraszam na duży pakiet związany z Apache Spark - od instalacji, poprzez stosunkowo mało zaawansowane tutoriale, a na debugowaniu i optymalizacji zapytań skończywszy.&lt;/p&gt;&#10;&lt;p&gt;Standardowo jest też trochę Pythona (na przykład świetny kurs spaCy - ale to fani &lt;a href="https://www.facebook.com/DaneAnalizy/"&gt;fanpage&amp;rsquo;a Dane i Analizy&lt;/a&gt; już znają czy też coś o wzorcach projektowych albo aplikacjach wielowątkowych), a w części &amp;ldquo;analiza danych&amp;rdquo; dość przekrojowe zagadnienia (np. &lt;em&gt;computer vision&lt;/em&gt; bez sieci neuronowych - dość sprytne podejście do tematu zajętych miejsc parkingowych).&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-04-11</title><link>https://blog.prokulski.science/2022/04/11/newsletter-dane-i-analizy-2022-04-11/</link><pubDate>Mon, 11 Apr 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/04/11/newsletter-dane-i-analizy-2022-04-11/</guid><description>&lt;p&gt;Trochę mniej artykułów, ale jeden z nich to potężny kolos (ten o SHAP). Do tego bardzo fajne porady dla początkujących w Pythonie i ciekawe koncepcje w świecie big data (jakby ktoś chciał postawić klaster to jest o tym poradnik).&lt;/p&gt;&#10;&lt;p&gt;Zaś w przyszłym tygodniu zrobimy sobie przerwę świąteczną - polewajcie się wodą za tydzień (oby pogoda dopisała), a nie zajmujcie się komputerami. Wesołych Świąt!&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="analiza_danych_koncepcje"&gt;#analiza_danych_koncepcje&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/revisiting-mnist-with-fresh-eyes-36f9d19a75d1"&gt;&lt;strong&gt;Revisiting MNIST with Fresh Eyes&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Każdy kto próbował machine learningu albo deep learningu (w szczególności sieci CNN) zetknął się ze zbiorem ręcznie pisanych cyfr MNIST. Tutaj inne podejście do znanego problemu&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-11-01</title><link>https://blog.prokulski.science/2021/11/01/newsletter-dane-i-analizy-2021-11-01/</link><pubDate>Mon, 01 Nov 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/11/01/newsletter-dane-i-analizy-2021-11-01/</guid><description>&lt;p&gt;&lt;a href="https://www.analyticsvidhya.com/blog/2021/10/beginners-guide-to-automl-with-an-easy-autogluon-example/"&gt;&lt;strong&gt;Beginner’s Guide to AutoML with an Easy AutoGluon Example&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;This article was published as a part of the Data Science Blogathon Machine Learning is popular and is being used everywhere for applications ranging from financial services to healthcare, marketing &amp;amp; advertising to manufacturing. Almost all industries seem to derive substantial benefit using some form of Machine Learning. Over the recent past, automation technology also […] The post (&amp;hellip;)&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/visualising-similarity-clusters-with-interactive-graphs-20a4b2a18534?source=rss----7f60cf5620c9---4"&gt;&lt;strong&gt;Visualising Similarity Clusters with Interactive Graphs&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Take advantage of Python, Plotly, and NetworkX to create interactive graphs to find similarity clusters Let us assume, as a running example, that my data is composed of word embeddings of the English language. I want to gain insights about the word distribution in the embedding space, specifically, if there are any clusters of very similar words, if there are words that are completely different (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-09-20</title><link>https://blog.prokulski.science/2021/09/20/newsletter-dane-i-analizy-2021-09-20/</link><pubDate>Mon, 20 Sep 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/09/20/newsletter-dane-i-analizy-2021-09-20/</guid><description>&lt;p&gt;&lt;a href="https://towardsdatascience.com/vlookup-implementation-in-python-in-three-simple-steps-93b5a290fd72"&gt;&lt;strong&gt;VLOOKUP implementation in Python in three simple steps&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Oftentimes, in the field of data analytics, it’s the data cleaning and processing that takes the most amount of time and effort. While the steps such as data cleaning, filtering, and pre-processing are generally under-evaluated or overlooked as compared to more juicy components such as the model development, it’s the quality of data that determines the quality of output. As it is rightly said, (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-09-13</title><link>https://blog.prokulski.science/2021/09/13/newsletter-dane-i-analizy-2021-09-13/</link><pubDate>Mon, 13 Sep 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/09/13/newsletter-dane-i-analizy-2021-09-13/</guid><description>&lt;p&gt;&lt;a href="https://towardsdatascience.com/still-using-the-os-module-in-python-this-alternative-is-remarkably-better-7d728ce22fb7"&gt;&lt;strong&gt;Still Using the OS Module in Python? This Alternative is Remarkably Better&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Python’s OS module is a nightmare for managing files and folders. You should try Pathlib. File and folder management with Python’s os module is a nightmare. Yet, it’s an essential part of every data science workflow. Saving reports, reading configuration files, you name it — there’s no way around it. Picture this — you spend weeks building an API around your model, and it works flawlessly, at (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-08-30</title><link>https://blog.prokulski.science/2021/08/30/newsletter-dane-i-analizy-2021-08-30/</link><pubDate>Mon, 30 Aug 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/08/30/newsletter-dane-i-analizy-2021-08-30/</guid><description>&lt;p&gt;&lt;a href="https://lucidmanager.org/data-science/monte-carlo-cost-estimates/"&gt;&lt;strong&gt;Monte Carlo Cost Estimates: Engineers Throwing Dice&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Estimating the cost of a complex project is not a trivial task. Traditional cost estimates are full of assumptions about the future state of the market and the final deliverable. Monte Carlo cost estimates are a tool to better understand the risks in your project and enable better cost control. Monte Carlo simulations are a technique to control your “known unknowns”. Albert Einstein famously said (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-07-31</title><link>https://blog.prokulski.science/2021/07/31/newsletter-dane-i-analizy-2021-07-31/</link><pubDate>Sat, 31 Jul 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/07/31/newsletter-dane-i-analizy-2021-07-31/</guid><description>&lt;p&gt;&lt;a href="https://medium.com/geekculture/how-to-model-time-between-events-using-the-exponential-gamma-and-poisson-distributions-4b058a357a55"&gt;&lt;strong&gt;How to Model Time Between Events Using the Exponential, Gamma, and Poisson Distributions&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;How to model time-to-event and ‘time between events’ on real data using the Exponential Family to optimize returns of time driven investments. Screenshots from within the article. Usually, when we have time as a variable on a dataset, we can model other variables reflected in time itself, whether we apply Time Series Analysis or just use time to cut our data and apply continual ML or S tate Space (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-06-14</title><link>https://blog.prokulski.science/2021/06/14/newsletter-dane-i-analizy-2021-06-14/</link><pubDate>Mon, 14 Jun 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/06/14/newsletter-dane-i-analizy-2021-06-14/</guid><description>&lt;p&gt;&lt;a href="https://chollinger.com/blog/2021/04/raspberry-pi-gardening-monitoring-a-vegetable-garden-using-a-raspberry-pi-part-1/"&gt;&lt;strong&gt;Raspberry Pi Gardening: Monitoring a Vegetable Garden using a Raspberry Pi - Part 1&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;On how growing vegetables is more complicated how it looks, why bad soldering still works, on moving individual bits around, and what I learned about using technology where one probably does not need technology.&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/air-piano-using-opencv-and-python-298cb22097d9?source=rss----7f60cf5620c9---4"&gt;&lt;strong&gt;Air Piano using OpenCV and Python&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Play the piano by just moving your fingers in the air! Taken from Unsplash My inspiration to make an “Air Piano” Recently I visited my cousin and she had been trying to learn piano for quite some time. However, due to the pandemic, her teacher could not come home and they were practising through (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-05-03</title><link>https://blog.prokulski.science/2021/05/03/newsletter-dane-i-analizy-2021-05-03/</link><pubDate>Mon, 03 May 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/05/03/newsletter-dane-i-analizy-2021-05-03/</guid><description>&lt;p&gt;&lt;a href="https://www.enterprisedb.com/blog/comparison-joins-mongodb-vs-postgresql"&gt;&lt;strong&gt;Comparison of JOINS: MongoDB vs. PostgreSQL | EDB&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;This is the second in a continuing series comparing MongoDB capabilities with those of Postgres. The first post covered “Schema Later Considered Harmful.”&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/using-machine-learning-to-predict-customers-next-purchase-day-7895ad49b4db"&gt;&lt;strong&gt;Using Machine Learning to Predict Customers Next Purchase Day&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Machine Learning model to predict whether customers will make their next purchase after a certain period. Image by Mediamodifier and can be accessed  here . Introduction If there is one major lesson that those in the retail business have learnt from the SARS-CoV-2 pandemic, it is the demand to (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Wyniki wyborów prezydenckich 2020 - coś więcej niż mapki</title><link>https://blog.prokulski.science/2020/07/19/wyniki-wyborow-prezydenckich-2020-cos-wiecej-niz-mapki/</link><pubDate>Sun, 19 Jul 2020 21:51:41 +0000</pubDate><guid>https://blog.prokulski.science/2020/07/19/wyniki-wyborow-prezydenckich-2020-cos-wiecej-niz-mapki/</guid><description>&lt;p&gt;Wybraliśmy nowego prezydenta Polski. Jak zwykle internet zalała seria mapek z wynikami. Ale czy mapki to wszystko co można wyciągnąć?&lt;/p&gt;&#10;&lt;p&gt;Mapkami podniecają się wszyscy, ale tak właściwie co one mówią o wynikach wyborów i osobach, które oddały swój głos? Dlaczego Andrzej Duda wygrał w jednych rejonach, a Rafał Trzaskowski w innych?&lt;/p&gt;&#10;&lt;p&gt;Oczywiście media teraz nieco &lt;em&gt;onanizują się&lt;/em&gt; tym, że jeden kandydat wygrał więcej gmin, a inny więcej województw (proporcjonalnie oczywiście). Mapkę narysować można zawsze (zresztą z wynikami po gminach publikowałem na Twitterze jako jeden z pierwszych - dlatego warto śledzić mnie na Twitterze), o tutaj:&lt;/p&gt;</description></item><item><title>Promocja na książki</title><link>https://blog.prokulski.science/2020/07/11/promocja-na-ksiazki/</link><pubDate>Sat, 11 Jul 2020 10:03:15 +0000</pubDate><guid>https://blog.prokulski.science/2020/07/11/promocja-na-ksiazki/</guid><description>&lt;p&gt;Jeszcze tylko do poniedziałku 13.07 &lt;strong&gt;&lt;a href="https://helion.pl/page/14029A/promocja/8850"&gt;promka wakacyjna&lt;/a&gt;&lt;/strong&gt; w Helionie, łapcie póki są porządne rabaty!&lt;/p&gt;&#10;&lt;ul&gt;&#10;&lt;li&gt;Deep learning z Kerasem w Pythonie, a konkretnie pozycja &lt;strong&gt;&lt;a href="https://helion.pl/view/14029A/delepy.htm"&gt;Deep Learning. Praca z językiem Python i biblioteką Keras&lt;/a&gt;&lt;/strong&gt; i wersja dla R: &lt;strong&gt;&lt;a href="https://helion.pl/view/14029A/delerk.htm"&gt;Deep Learning. Praca z językiem R i biblioteką Keras&lt;/a&gt;&lt;/strong&gt;&lt;/li&gt;&#10;&lt;li&gt;Ponoć najlepsza książka do nauki Pythona &lt;strong&gt;&lt;a href="https://helion.pl/view/14029A/autopy.htm"&gt;Automatyzacja nudnych zadań z Pythonem. Nauka programowania&lt;/a&gt;&lt;/strong&gt;&lt;/li&gt;&#10;&lt;li&gt;Oraz dla równowagi - najlepsza książka do nauki R: &lt;strong&gt;&lt;a href="https://helion.pl/view/14029A/jezrkv.htm"&gt;Język R. Kompletny zestaw narzędzi dla analityków danych&lt;/a&gt;&lt;/strong&gt;&lt;/li&gt;&#10;&lt;li&gt;Analiza danych to też SQL, zatem &lt;strong&gt;&lt;a href="https://helion.pl/view/14029A/pksql3.htm"&gt;Praktyczny kurs SQL&lt;/a&gt;&lt;/strong&gt;&lt;/li&gt;&#10;&lt;li&gt;Najlepszym środowiskiem do pracy jest mimo wszystko Linux - podstawy złapiesz dzięki &lt;strong&gt;&lt;a href="https://helion.pl/view/14029A/linkp5.htm"&gt;Linux. Komendy i polecenia&lt;/a&gt;&lt;/strong&gt;&lt;/li&gt;&#10;&lt;li&gt;Ale nie wszystko musisz mieć zainstalowane na jakimś serwerze - są rozwiązania kontenerowe, więc &lt;strong&gt;&lt;a href="https://helion.pl/view/14029A/docke2.htm"&gt;Docker. Praktyczne zastosowania&lt;/a&gt;&lt;/strong&gt; może okazać się dobrym pomysłem.&lt;/li&gt;&#10;&lt;li&gt;Chyba, że wolisz pozostać w świecie Excela, wówczas przyda Ci się &lt;strong&gt;&lt;a href="https://helion.pl/view/14029A/e19bib.htm"&gt;Biblia Excela&lt;/a&gt;&lt;/strong&gt;. Sposobem na przejście do bardziej zaawansowanych technik jest Power Query, w korporacjach przyda się więc &lt;strong&gt;&lt;a href="https://helion.pl/view/14029A/poquex.htm"&gt;Power Query w Excelu i Power BI. Zbieranie i przekształcanie danych&lt;/a&gt;&lt;/strong&gt;.&lt;/li&gt;&#10;&lt;/ul&gt;&#10;&lt;p&gt;Więcej książek w ramach promocji znajdziecie &lt;a href="https://helion.pl/page/14029A/promocja/8850"&gt;na stronie&lt;/a&gt;.&lt;/p&gt;</description></item></channel></rss>