<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>LinkedIn on Łukasz Prokulski, Dane i Analizy</title><link>https://blog.prokulski.science/tags/linkedin/</link><description>Recent content in LinkedIn on Łukasz Prokulski, Dane i Analizy</description><generator>Hugo</generator><language>pl-PL</language><lastBuildDate>Mon, 06 Jul 2026 15:00:00 +0000</lastBuildDate><atom:link href="https://blog.prokulski.science/tags/linkedin/index.xml" rel="self" type="application/rss+xml"/><item><title>Lokalni agenci, schema evolution i najgorsze błędy XGBoost</title><link>https://blog.prokulski.science/2026/07/06/lokalni-agenci-schema-evolution-i-najgorsze-bledy-xgboost/</link><pubDate>Mon, 06 Jul 2026 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2026/07/06/lokalni-agenci-schema-evolution-i-najgorsze-bledy-xgboost/</guid><description>&lt;p&gt;To wydanie zadaje dwa pytania, które wielu z nas ma gdzieś z tyłu głowy: czy narzędzia, których używam na co dzień, to nadal dobry wybór - i czy warto rozejrzeć się za czymś nowym? Na tapecie znalazły się dbt Core 2.0, DuckDB jako zamiennik Pandas, lokalne agenty AI do pisania kodu oraz nowe modele uczenia maszynowego, które chcą wypchnąć XGBoost z piedestału. Jeśli masz wrażenie, że świat danych zmienia się szybciej niż jesteś w stanie za nim nadążyć - ten numer to potwierdza.&lt;/p&gt;</description></item><item><title>Semantic layer, czarne skrzynki i 30 lat Postgresa kontra cały Twój stack</title><link>https://blog.prokulski.science/2026/04/20/semantic-layer-czarne-skrzynki-i-30-lat-postgresa-kontra-caly-twoj-stack/</link><pubDate>Mon, 20 Apr 2026 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2026/04/20/semantic-layer-czarne-skrzynki-i-30-lat-postgresa-kontra-caly-twoj-stack/</guid><description>&lt;p&gt;Tym razem data engineering trzyma środek ciężkości całego wydania — i robi to z rozmachem.&lt;/p&gt;&#10;&lt;p&gt;DuckLake osiąga wersję 1.0 jako pełnoprawna platforma lakehouse oparta na Apache Iceberg, dbt publikuje świeży benchmark semantic layer kontra text-to-SQL, a Meta dzieli się case study o tym, jak użyła NLP do mapowania wiedzy w pipeline&amp;rsquo;ach danych.&lt;/p&gt;&#10;&lt;p&gt;Do kompletu:&lt;/p&gt;&#10;&lt;p&gt;architektura medallion z warstwą semantyczną, 20 reguł walidacji, które powinny być standardem w każdym pipeline, i konkretny materiał Airbnb o wysokowydajnym pipeline metryk na OpenTelemetry.&lt;/p&gt;</description></item><item><title>Sporo Streamlit i tutoriali budowania Agnetów AI</title><link>https://blog.prokulski.science/2025/09/08/sporo-streamlit-i-tutoriali-budowania-agnetow-ai-newsletter-dane-i-analizy--y-m-d/</link><pubDate>Mon, 08 Sep 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/09/08/sporo-streamlit-i-tutoriali-budowania-agnetow-ai-newsletter-dane-i-analizy--y-m-d/</guid><description>&lt;p&gt;Gdy jedni wciąż zastanawiają się, czy warto eksperymentować z agentami AI, inni już budują kompletne systemy analityczne z Pydantic-AI i Streamlit. Gdy niektóre zespoły mierzą się z podstawową konfiguracją Kafki, inne optymalizują przepustowość na poziomie miliona wiadomości na sekundę. Między innymi o tym dzisiaj.&lt;/p&gt;&#10;&lt;p&gt;&lt;strong&gt;Rewolucja agentów AI&lt;/strong&gt; - od zera do działającego agenta z LangGraph, plus praktyczne połączenie Streamlit z Pydantic-AI do analizy danych. To nie są już tylko proof-of-concept, to konkretne narzędzia robocze.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-07-07</title><link>https://blog.prokulski.science/2025/07/07/newsletter-dane-i-analizy-2025-07-07/</link><pubDate>Mon, 07 Jul 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/07/07/newsletter-dane-i-analizy-2025-07-07/</guid><description>&lt;p&gt;Ten tydzień przyniósł szczególnie bogate żniwo materiałów technicznych – po zwyczajowej analizie dziesiątek źródeł i setek (jeśli nie tysięcy) artykułów, udało się wyłonić zwyczajowe &amp;ldquo;około dwadzieścia&amp;rdquo; najważniejszych publikacji z obszaru data science, ML i AI. Rozkład tematyczny doskonale odzwierciedla aktualne trendy w branży (i zainteresowania Redaktora Naczelnego): dominuje Python i Data Engineering. Ale (poza zainteresowaniami Naczelnego) potwierdza to centralną rolę tych obszarów w nowoczesnych zagadnieniach związanych z danymi.&lt;/p&gt;&#10;&lt;p&gt;Szczególnie interesujące są materiały dotyczące architektury systemów AI – od multi-agentowych rozwiązań Anthropic, przez unifikację ML na Ray w Pinterest, aż po praktyczne implementacje MLOps z pełnym monitoringiem. Widać wyraźnie, że branża przechodzi od eksperymentów do produkcyjnych, skalowalnych rozwiązań.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-06-23</title><link>https://blog.prokulski.science/2025/06/23/newsletter-dane-i-analizy-2025-06-23/</link><pubDate>Mon, 23 Jun 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/06/23/newsletter-dane-i-analizy-2025-06-23/</guid><description>&lt;p&gt;Witaj w kolejnym numerze, który jak zwykle został przygotowany z myślą o tym, żebyś nie musiał(a) przebijać się samodzielnie przez 500 artykułów tygodniowo w poszukiwaniu prawdziwych perełek. Tym razem szczególnie różnorodny zestaw - od trenowania modeli językowych, przez serwery MCP i praktyczne implementacje w Pythonie (w szczególności przepływów danych i wykresów), aż po narzędzia, które mogą realnie zmienić użycie konsoli.&lt;/p&gt;&#10;&lt;p&gt;Ciekawostką tego numeru jest analiza protestu wyborczego z polskich wyborów 2025 - rzadko kiedy mamy okazję zobaczyć, jak statystyka spotyka się z rzeczywistością polityczną w tak bezpośredni sposób.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-06-16</title><link>https://blog.prokulski.science/2025/06/16/newsletter-dane-i-analizy-2025-06-16/</link><pubDate>Mon, 16 Jun 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/06/16/newsletter-dane-i-analizy-2025-06-16/</guid><description>&lt;p&gt;Mamy poniedziałek rano, więc zaparzaj kawę i przygotuj się na rozpoczęcie tygodnia z porcją wiedzy z świata danych i sztucznej inteligencji.&lt;/p&gt;&#10;&lt;p&gt;Witam przede wszystkich nowych subskrybentów! Zgodnie z obietnicą (warto śledzić moje social media): oto moja najnowsza książka mówiącej o tym, co trzeba umieć, aby pracować z danymi - od zupełnych podstaw w Excelu do dużych projektów data-inżynieryjnych, modeli AI czy dashboardów dla zarządów największych spółek.&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://prokulski.science/temp/static/jak-zostac-analitykiem.pdf?utm_source=newsletter-dia-2025-06-16&amp;amp;utm_medium=mail-link&amp;amp;utm_campaign=daneianalizy"&gt;&lt;img src="https://prokulski.science/temp/static/jak-zostac-analitykiem-small.jpg" alt=""&gt;&lt;/a&gt;&lt;/p&gt;&#10;&lt;p&gt;Książka na razie dostępna jest za darmo, więc należy się śpieszyć. To wersja 1.0.beta, więc wszystkie uwagi mile widziane!&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-06-09</title><link>https://blog.prokulski.science/2025/06/09/newsletter-dane-i-analizy-2025-06-09/</link><pubDate>Mon, 09 Jun 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/06/09/newsletter-dane-i-analizy-2025-06-09/</guid><description>&lt;p&gt;Dzisiaj momentami jest grubo - na przykład matematyczna elegancja B-spline&amp;rsquo;ów. Ale jest też trochę praktyki w DuckDB. Jeśli myślisz, że świat danych to tylko nudne CSVki i niekończące się ETLe, ten numer (mam nadzieję) przekona Cię, że to naprawdę fascynująca dziedzina pełna niespodzianek.&lt;/p&gt;&#10;&lt;p&gt;Szczególnie polecam zwrócić uwagę na historię firmya Tencent Music, która oszczędziła 80% kosztów przenosząc się z Elasticsearch na Apache Doris - to jeden z tych przypadków, gdy zmiana architektury naprawdę się opłaca. Z kolei dla miłośników optymalizacji opowieść o tym, jak Python API można przyspieszyć 10x bez przepisywania na Go czy Rust - czasem wystarczy po prostu dobrze pomyśleć!&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-06-02</title><link>https://blog.prokulski.science/2025/06/02/newsletter-dane-i-analizy-2025-06-02/</link><pubDate>Mon, 02 Jun 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/06/02/newsletter-dane-i-analizy-2025-06-02/</guid><description>&lt;p&gt;Ten tydzień przyniósł interesującą mieszankę praktycznych rozwiązań i technologicznych rewolucji. Od monitorowania nocnych maratonów chomików (to ta rewolucja, wiadomo) po architekturę Apache Spark - branża pokazuje, że innowacja kryje się w każdym zakątku.&lt;/p&gt;&#10;&lt;p&gt;Szczególnie ciekawy jest trend odchodzenia od tradycyjnych rozwiązań na rzecz nowoczesnych alternatyw. Na przykład zamiast odpalać joby w cronie można wykorzystać Change Data Capture (CDC), a API-first podejście staje się standardem dla 74% zespołów. Apache Iceberg wygra wojnę formatów tabel, a FastAPI udowadnia, że Python może być równie wydajny co elegancki.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-05-26</title><link>https://blog.prokulski.science/2025/05/26/newsletter-dane-i-analizy-2025-05-26/</link><pubDate>Mon, 26 May 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/05/26/newsletter-dane-i-analizy-2025-05-26/</guid><description>&lt;p&gt;Witajcie w kolejnym numerze, który przypomina mi swego rodzaju podróż przez świat danych - od praktycznych problemów po filozoficzne rozważania o przyszłości naszej branży.&lt;/p&gt;&#10;&lt;p&gt;Zaczynamy od fundamentów: jak radzić sobie z brakującymi danymi (bo zawsze jest ich za mało, czasem jest ich za dużo ale są wybrakowane), dlaczego UUIDy mogą zabijać PostgreSQLa, i jak Uber (dzisiaj dużo o nim) radzi sobie z backupami petabajtów danych. To te rzeczy, które każdy z nas prędzej czy później musi ogarnąć, ale rzadko kto mówi o nich głośno na spotkaniach.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-05-19</title><link>https://blog.prokulski.science/2025/05/19/newsletter-dane-i-analizy-2025-05-19/</link><pubDate>Mon, 19 May 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/05/19/newsletter-dane-i-analizy-2025-05-19/</guid><description>&lt;p&gt;W świecie, który coraz mocniej stawia na wykorzystanie sztucznej inteligencji, OpenAI wprowadza Codex - asystenta AI, który może tworzyć kod na podstawie prostych instrukcji tekstowych. Tymczasem ciekawy eksperyment z czterema różnymi modelami LLM poddanymi zadaniu projektowania architektury oprogramowania pokazuje, gdzie obecnie stoją możliwości AI w zastępowaniu ludzkich specjalistów. Pytanie &lt;strong&gt;&amp;ldquo;co dalej z Eldorado?&amp;rdquo;&lt;/strong&gt; pozostaje w mocy?&lt;/p&gt;&#10;&lt;p&gt;Nie brakuje też w dzisiejszym wydaniu konkretnych tutoriali i praktycznych przewodników - od budowy systemów przetwarzania danych w Airflow 3 z wykorzystaniem AI SDK i analizę danych z League of Legends, albo z Ligi Mistrzów UEFA, po tworzenie efektownych wizualizacji takich jak mapy kafelkowe czy wykresy parlamentarne (mimo, że mamy wybory prezydenckie). Dla fanów uczenia maszynowego mam artykuły o klasycznych algorytmach klasyfikacyjnych i praktycznym łączeniu bibliotek Pandas, NumPy i scikit-learn. Plus &lt;a href="https://www.subscribepage.com/python_data_science/?utm_source=newsletter-dia-2025-05-19&amp;amp;utm_medium=link-wstep&amp;amp;utm_campaign=daneianalizy"&gt;swój własny cykl&lt;/a&gt; uczący analizy danych.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-05-12</title><link>https://blog.prokulski.science/2025/05/12/newsletter-dane-i-analizy-2025-05-12/</link><pubDate>Mon, 12 May 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/05/12/newsletter-dane-i-analizy-2025-05-12/</guid><description>&lt;p&gt;Przed Tobą starannie wyselekcjonowane materiały z całego internetu, które pomogą Ci być na bieżąco ze światem danych, AI i programowania. Z ponad 500 źródeł, które wpadły do sitka w tym tygodniu, wybrałem te najbardziej wartościowe i inspirujące.&lt;/p&gt;&#10;&lt;p&gt;W tym wydaniu znajdziesz sporo praktycznych materiałów o Pythonie - od łączenia z bazami danych, przez wielowątkowe przetwarzanie z Joblib, po kolejkowanie zadań z Procrastinate. Dla miłośników AI, LLMów i RAGów są teksty o budowaniu własnych systemów przetwarzania dokumentów oraz optymalizacji pipeline&amp;rsquo;ów RAG.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-05-05</title><link>https://blog.prokulski.science/2025/05/05/newsletter-dane-i-analizy-2025-05-05/</link><pubDate>Mon, 05 May 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/05/05/newsletter-dane-i-analizy-2025-05-05/</guid><description>&lt;p&gt;Tym razem, pomimo majówki, zebrałem specjalnie dla Ciebie kolekcję tekstów, które łączy jeden wspólny mianownik - praktyczność. Mniej teorii, więcej konkretów, które możesz zastosować już dziś w swojej pracy z danymi i kodem.&lt;/p&gt;&#10;&lt;p&gt;W świecie AI i ML możesz przyjrzeć się technikom monitorowania sieci neuronowych podczas treningu oraz implementacji autokoderów wariacyjnych z Keras. Oba teksty to solidne przewodniki, które pomogą Ci lepiej zrozumieć, co dzieje się &amp;ldquo;pod maską&amp;rdquo; Twoich modeli.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-04-21</title><link>https://blog.prokulski.science/2025/04/21/newsletter-dane-i-analizy-2025-04-21/</link><pubDate>Mon, 21 Apr 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/04/21/newsletter-dane-i-analizy-2025-04-21/</guid><description>&lt;p&gt;Pomimo trwających świąt (chociaż już za moment &lt;em&gt;&amp;ldquo;święta, święta i po świętach&amp;rdquo;&lt;/em&gt;) dość obfita paczka materiałów leci do Ciebie.&lt;/p&gt;&#10;&lt;p&gt;Dzisiaj praktyczne zastosowania &lt;em&gt;computer vision&lt;/em&gt; w śledzeniu piłkarzy oraz implementację mechanizmu uwagi z architektury Transformer, pokazując jak zaawansowane modele mogą być budowane od podstaw. Dla tych, którzy podkręcają zapytania SQL - coś o ich optymalizacji w PostgreSQL. Do tego oraz kompleksowy przewodnik po budowie nowoczesnych hurtowni danych.&lt;/p&gt;&#10;&lt;p&gt;Deweloperzy znajdą wartościowe treści dotyczące automatyzacji procesów z wykorzystaniem Jenkins i integracji z GitHubem, a także automatyzacji przeglądów kodu przy pomocy modeli LLM. W sekcji Python szereg praktycznych narzędzi - od integracji JWT z FastAPI, przez korzystanie z biblioteki HTTPX, po wizualizację danych z Excela przy użyciu Dash.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-04-14</title><link>https://blog.prokulski.science/2025/04/14/newsletter-dane-i-analizy-2025-04-14/</link><pubDate>Mon, 14 Apr 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/04/14/newsletter-dane-i-analizy-2025-04-14/</guid><description>&lt;p&gt;Ciepłe powitanie dla wszystkich nowych czytelników, którzy dołączyli razem z cyklem o analizie danych z rynku pierwotnego nieruchomości! Cieszę się, że tu jesteście. A jeśli ktoś nie zna tego cyklu - zapraszam na stronę, &lt;a href="https://www.subscribepage.com/python_data_science/?utm_source=mail-2025-04-14&amp;amp;utm_medium=dia-nlt&amp;amp;utm_campaign=newsletter-dia"&gt;gdzie można się zapisać&lt;/a&gt;. Za zupełną darmoszkę.&lt;/p&gt;&#10;&lt;p&gt;W tym tygodniu przygotowałem zestaw materiałów, które odzwierciedlają dynamiczny rozwój świata AI, analizy danych i programowania. Szczególnie interesujące wydają się nowinki z pogranicza multimodalnych modeli AI, gdzie można własnoręcznie zbudować odpowiednik GPT-4o, oraz projekt analizujący trendy w segmentach sponsorskich na YouTube.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-04-07</title><link>https://blog.prokulski.science/2025/04/07/newsletter-dane-i-analizy-2025-04-07/</link><pubDate>Mon, 07 Apr 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/04/07/newsletter-dane-i-analizy-2025-04-07/</guid><description>&lt;p&gt;Dzisiaj &amp;ldquo;mapy rozwoju&amp;rdquo; - czyli listy zagadnień, które warto poznać, zgłębić, nauczyć się, aby rozwinąć się w danej dziedzinie. Dziedziny te oczywiście bliskie są tematom przewodnim tego newslettera - przetwarzaniu danych. Zatem jest &amp;ldquo;ścieżka rozwojowa&amp;rdquo; dla inżynierów danych oraz dla zajmujących się machine learningiem (i jego &amp;ldquo;operacjonalizacyjną&amp;rdquo; stroną - MLOps).&lt;/p&gt;&#10;&lt;p&gt;Ciekawe dla Ciebie mogą być również dwa świeże raporty (za 2024 rok) związane z bezpieczeństwem - jeden z CERT, więc bezpieczeństwo raczej ogólne. Drugi z Komisji Nadzoru Finansowego dotyczący instytucji finansowych.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2025-03-10</title><link>https://blog.prokulski.science/2025/03/10/newsletter-dane-i-analizy-2025-03-10/</link><pubDate>Mon, 10 Mar 2025 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2025/03/10/newsletter-dane-i-analizy-2025-03-10/</guid><description>&lt;p&gt;Pod koniec lutego &amp;ldquo;ukazał&amp;rdquo; się zbiór danych (pochodzących najprawdopodobniej z serwisu rynekpierwotny.pl) zawierający całkiem sporo ofert nowych mieszkań (i nie tylko). Zbiór o tyle interesujący, że ze współrzędnymi oferowanych lokalizacji. Na &lt;a href="https://www.linkedin.com/feed/update/urn:li:activity:7302029418514857984/"&gt;LinkedIn&lt;/a&gt; wrzuciłem na szybko przygotowaną mapkę wynikającą z tego zbioru, ale planuję coś większego: e-mailowy cykl (3-4 maile, pewnie co tydzień) pokazujący co z tymi danymi można zrobić. Na pewno napiszę o tym w newsletterze, na pewno napiszę o tym na LinkedIn - zatem zapraszam do obserwowania. Na &lt;a href="https://www.facebook.com/DaneAnalizy/"&gt;fanpage&amp;rsquo;u Dane i Analizy&lt;/a&gt; też będzie o tym info, więc też warto obserwować.&lt;br&gt;&#10;Żeby było ciekawiej - dość podobny temat porusza jeden z dzisiejszych postów, jakie znajdziesz poniżej - ten o kebabach - to doskonały przykład praktycznego zastosowania analizy danych.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-09-02</title><link>https://blog.prokulski.science/2024/09/02/newsletter-dane-i-analizy-2024-09-02/</link><pubDate>Mon, 02 Sep 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/09/02/newsletter-dane-i-analizy-2024-09-02/</guid><description>&lt;p&gt;Od kilku tygodni (może bardziej kilkunastu dni?) na LinkedIn widać pochwały dla &lt;a href="https://bielik.ai/"&gt;Bielika&lt;/a&gt; - polskiego czat-bota opracowanego na bazie modelu Mistral-7B. &lt;a href="https://cyberdefence24.pl/technologie/bielik-wyladowal-sprawdzilismy-jak-dziala-polski-chatbot"&gt;Tutaj&lt;/a&gt; możecie poczytać swego rodzaju &lt;em&gt;test&lt;/em&gt; tego modelu. Polecamy własne eksperymenty (ciekawym jest prompt &amp;ldquo;Przygotuj dialog pomiędzy Janem i Marią, dwojgiem polskich emerytów spotykających się pomiędzy apteką a sklepem spożywczym&amp;rdquo; - ChatGPT, Cloude, Gemini - próbujcie, kto da bardziej &amp;ldquo;polską&amp;rdquo; odpowiedź). Co ważne - Bielik w wersji 2.2 jest dostępny na licencji Apache 2.0, która pozwala na swobodne używanie, modyfikowanie i redystrybucję oprogramowania, w tym w celach komercyjnych. Jedynym wymaganiem jest zachowanie oryginalnej licencji i noty prawnej przy każdej redystrybucji.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-08-26</title><link>https://blog.prokulski.science/2024/08/26/newsletter-dane-i-analizy-2024-08-26/</link><pubDate>Mon, 26 Aug 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/08/26/newsletter-dane-i-analizy-2024-08-26/</guid><description>&lt;p&gt;Poniżej znajdziecie tekst opisujący Ghostbuster - narzędzie do wykrywania czy tekst został napisany przez AI. Dawno temu &lt;a href="../../2017/06/30/kto-napisal-te-ksiazke/"&gt;na blogu napisałem&lt;/a&gt; (kod jeszcze w R) coś w dużej mierze podobnego, ale tam celem było przyporządkowanie autora (jednego z dwóch) do tekstu. W banalny sposób, oparty jedynie na statystyce. Przeczytaj artykuł o Ghostbuster i zobacz jak zmieniło się to na przestrzeni lat (mój tekst ma 7 lat!)&amp;hellip; W podobnym czasie na Kaggle był konkurs &lt;a href="https://www.kaggle.com/competitions/spooky-author-identification"&gt;Spooky Author Identification&lt;/a&gt; - o wiele krótsze teksty, a w najnowszych &lt;a href="https://www.kaggle.com/competitions/spooky-author-identification/code"&gt;rozwiązaniach&lt;/a&gt; pojawiają się transformery.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-08-12</title><link>https://blog.prokulski.science/2024/08/12/newsletter-dane-i-analizy-2024-08-12/</link><pubDate>Mon, 12 Aug 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/08/12/newsletter-dane-i-analizy-2024-08-12/</guid><description>&lt;p&gt;Używacie &lt;strong&gt;Postmana&lt;/strong&gt; do współpracy z API? Na przykład do testowania własnych usług albo rozpoznawania cudzych? &lt;strong&gt;Poznajcie&lt;/strong&gt; &lt;a href="https://github.com/usebruno/bruno/blob/main/docs/readme/readme_pl.md"&gt;&lt;strong&gt;Bruno&lt;/strong&gt;&lt;/a&gt; - alternatywę, w 100% offline i open soruce. Bruno jest oddzielną aplikacją (okienkową i w CLI) oraz dodatkiem do VSCode. Zamiast czytać możecie też zobaczyć &lt;a href="https://www.youtube.com/watch?v=b_ctmKlEOXg"&gt;kilkunastominutowe demo&lt;/a&gt;.&lt;/p&gt;&#10;&lt;p&gt;&amp;ldquo;Czego powinniśmy się spodziewać, a co jest tylko szumem medialnym? Jaka jest różnica między obietnicą tej technologii a praktyczną rzeczywistością?&amp;rdquo;. Najnowszy artykuł Stephanie Kirmer (&lt;a href="https://towardsdatascience.com/economics-of-generative-ai-75f550288097"&gt;&lt;strong&gt;Ekonomia generatywnej AI&lt;/strong&gt;&lt;/a&gt;) przedstawia bezpośrednie, bezkompromisowe spojrzenie na biznesowe przypadki produktów AI oraz zadaje pytanie, o to jaki jest model biznesowy dla generatywnej AI, biorąc pod uwagę to, co wiemy dzisiaj o technologii i rynku?&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-06-17</title><link>https://blog.prokulski.science/2024/06/17/newsletter-dane-i-analizy-2024-06-17/</link><pubDate>Mon, 17 Jun 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/06/17/newsletter-dane-i-analizy-2024-06-17/</guid><description>&lt;p&gt;W minionym tygodniu miało swoją premierę narzędzie, które w ramach GenAI potrafi ożywić zdjęcia. Mowa o &lt;a href="https://lumalabs.ai/dream-machine"&gt;Luma&lt;/a&gt;. Oczywiście pojawiło się już kilka &lt;a href="https://sztucznainteligencjablog.pl/blog/ozywione-memy-za-pomoca-luma-ai-dream-machine/"&gt;ożywionych memów&lt;/a&gt; albo &lt;a href="https://www.linkedin.com/posts/matthieulorrain_genai-music-lumaai-activity-7207754739105574912-nMfJ"&gt;okładek płyt&lt;/a&gt;. W ciekawą idzie to stronę&amp;hellip; Pamiętajcie jednak, że zanim wrzucicie w tego typu maszynki swoje prywatne zdjęcia żeby przeczytać regulamin (ten z LumaLabs AI na wiele im pozwala).&lt;/p&gt;&#10;&lt;p&gt;W minionym tygodniu rozpoczęło się też Euro 2024 i to pewnie części z Was zajmuje sporo czasu. Szkoda tylko, że FiveThirtyEight.com przestało się zajmować sportem - bardzo fajne modele predykcyjne mieli na temat sportu. Za to (przed startem turnieju) swoje predykcje przygotował &lt;a href="https://eurosport.tvn24.pl/pilka-nozna/euro-2024/2024/analiza-szans-polski-w-euro-2024.-znamy-mistrza-i-rewelacje-euro-2024_sto10194122/story.shtml"&gt;Eurosport&lt;/a&gt;.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-11-19</title><link>https://blog.prokulski.science/2023/11/19/newsletter-dane-i-analizy-2023-11-19/</link><pubDate>Sun, 19 Nov 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/11/19/newsletter-dane-i-analizy-2023-11-19/</guid><description>&lt;p&gt;Ci, którzy śledzą newsletter i fanpage&amp;rsquo;a &lt;a href="https://www.facebook.com/DaneAnalizy/"&gt;Dane i Analizy&lt;/a&gt;, profil na &lt;a href="https://www.linkedin.com/company/daneianalizy/"&gt;LinkedIn&lt;/a&gt; (oraz moje prywatne profile, np. na &lt;a href="https://www.linkedin.com/in/lukaszprokulski/"&gt;LI&lt;/a&gt;) wiedzą zapewne, że w ramach kampanii PZU &lt;em&gt;silni w IT&lt;/em&gt; przygotowaliśmy serię podcastów o sztucznej inteligencji.&lt;/p&gt;&#10;&lt;p&gt;W pierwszym odcinku rozmawiamy raczej filozoficznie, o tym czym jest AI i czy potrzebujemy dla niej jakichś regulacji (słuchaj na &lt;a href="https://www.youtube.com/watch?v=ZmDAWVjK6ds"&gt;YouTube&lt;/a&gt; lub &lt;a href="https://open.spotify.com/episode/5fLSczI7mHzGFtRMmLFAQ4"&gt;Spotify&lt;/a&gt;).&lt;br&gt;&#10;W drugim skupiamy się na zagadnieniach HRowych - kim jest data scientist, co robi i - to chyba najważniejsze - jakich kompetencji się oczekuje od takiej osoby? (&lt;a href="https://open.spotify.com/episode/6BTwToPD0yaX6l2N40Jf36"&gt;Spotify&lt;/a&gt; / &lt;a href="https://www.youtube.com/watch?v=YXTfZ9wzHw0"&gt;YouTube&lt;/a&gt;).&lt;br&gt;&#10;W tym tygodniu powinny pojawić się dwa kolejne odcinki, w kolejnym jeszcze dwa. Poruszamy w nich zagadnienia związane z big data i dostarczaniem danych do nauki AI, rozmawiamy o computer vision, modelach językowych, a na koniec bezpieczeństwie.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-11-13</title><link>https://blog.prokulski.science/2023/11/13/newsletter-dane-i-analizy-2023-11-13/</link><pubDate>Mon, 13 Nov 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/11/13/newsletter-dane-i-analizy-2023-11-13/</guid><description>&lt;p&gt;Za chwilę w świat pójdą pierwsze odcinki nowego podcastu przygotowanego przez zespół Big Data &amp;amp; AI PZU: &lt;strong&gt;#SilniwIT o technologiach&lt;/strong&gt;. To seria, w ramach której rozmawiam (wspólnie z Tomkiem z zespołu Fabryki Sztucznej Inteligencji) z gośćmi o szeroko pojętej sztucznej inteligencji. Wypatrujcie postów na &lt;a href="https://www.facebook.com/DaneAnalizy/"&gt;FB&lt;/a&gt;, &lt;a href="https://www.linkedin.com/company/daneianalizy/"&gt;LinkedIn&lt;/a&gt; i pewnie w przyszłym newsletterze - mam nadzieję, że jak na amatorów - daliśmy radę. Staraliśmy się ucinać korpo-gadkę, powinno być interesująco ;-)&lt;/p&gt;&#10;&lt;p&gt;Wcześniej możecie posłuchać podsumowania z pierwszej konferencji OpenAI (firmy, która stworzyła ChatGPT) dla developerów w podcaście &lt;a href="https://podcasters.spotify.com/pod/show/artur-kurasinski/episodes/Podsumowanie-OpenAI-DevDay-2023-e2bles4"&gt;Technofobia&lt;/a&gt; Artura Kurasińskiego.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2023-02-27</title><link>https://blog.prokulski.science/2023/02/27/newsletter-dane-i-analizy-2023-02-27/</link><pubDate>Mon, 27 Feb 2023 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2023/02/27/newsletter-dane-i-analizy-2023-02-27/</guid><description>&lt;p&gt;W dzisiejszym wydaniu najwięcej miejsca poświęcam wizualizacji danych i okolicach.&lt;/p&gt;&#10;&lt;p&gt;Kalibracja obrazu jest okolicą (bardzo odległą - w sumie oba tematy łączy tylko to, że mamy do czynienia z obrazem), jest też więc coś o tym. Kalibracja jest potrzebna przy problemach natury &lt;em&gt;computer vision&lt;/em&gt;, a takowy - w postaci maskowania obiektów na obrazie - też dzisiaj poruszamy.&lt;/p&gt;&#10;&lt;p&gt;W poprzednim tygodniu dużym powodzeniem cieszył się tekst o MLOps (jeśli boisz się, że umknęło - zerknij do &lt;a href="../../category/newsletter/"&gt;archiwum&lt;/a&gt;), więc dzisiaj kontynuacja, niejako na fali z poprzedniego tygodnia.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-12-19</title><link>https://blog.prokulski.science/2022/12/19/newsletter-dane-i-analizy-2022-12-19/</link><pubDate>Mon, 19 Dec 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/12/19/newsletter-dane-i-analizy-2022-12-19/</guid><description>&lt;p&gt;Po Mundialu, można się rozejść. W tym tygodniu lekkie wytchnienie, potem święta, święta i po świętach.&lt;/p&gt;&#10;&lt;p&gt;W związku z tym życzę Państwu wszystkiego najlepszego, rodzinnych, spokojnych świąt. Odstawcie modele ML, dostawcie Flinki, Sparki i Kafki, zajmijcie się uszkami w barszczu i prezentami spod choinki. No, może być Pinot&amp;hellip; Pinot Noir.&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="ai_ml"&gt;#AI_ML&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://pub.towardsai.net/10-commonly-used-loss-functions-explained-with-python-code-59967e1f3c8d"&gt;&lt;strong&gt;10 Commonly Used Loss Functions Explained with Python Code&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Loss Function czy też bardziej swojsko &amp;ldquo;funkcja straty&amp;rdquo; to taka funkcja, która jest minimalizowana przez algorytm ML. A jakie mogą to być funkcje?&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-09-26</title><link>https://blog.prokulski.science/2022/09/26/newsletter-dane-i-analizy-2022-09-26/</link><pubDate>Mon, 26 Sep 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/09/26/newsletter-dane-i-analizy-2022-09-26/</guid><description>&lt;p&gt;Wracamy do rysowania wykresów, pobierania danych ze stron internetowych oraz robienia dashboardów (i raportów w Wordzie). To dzisiejsze główne punkty zainteresowań. Ale dla fanów rozwiązań big data też coś się znajdzie.&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="analiza_danych_projekty"&gt;#analiza_danych_projekty&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://blog.platypush.tech/article/Automate-your-music-collection"&gt;&lt;strong&gt;Automate your music collection&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Znudziły Ci się playlisty Spofity? Ciągle słuchasz &amp;ldquo;ulubionych&amp;rdquo;? Być może Ci to odpowiada. Ale jeśli lubisz odkrywać nową muzykę to możesz czuć się jak w bańce. Albo wykorzystać historię odtwarzanych utworów oraz API serwisu Last.fm żeby poznać coś nowego&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-03-14</title><link>https://blog.prokulski.science/2022/03/14/newsletter-dane-i-analizy-2022-03-14/</link><pubDate>Mon, 14 Mar 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/03/14/newsletter-dane-i-analizy-2022-03-14/</guid><description>&lt;p&gt;Mam nadzieję, że wiosna nadchodzi wielkimi krokami, więc dzisiaj trochę lżejszy dobór tematów.&lt;/p&gt;&#10;&lt;p&gt;Koniecznie zobacz nagranie z webinaru u Vladimira o BI i ML!&lt;/p&gt;&#10;&lt;p&gt;Polecam też zainteresować się Mermaid - rozszerzeniem do Markdown pozwalającym rysować diagramy. Da się też eksportować je później do np. PDFów - istnieje odpowiedni &lt;a href="https://github.com/raghur/mermaid-filter"&gt;dodatek do pandoc&lt;/a&gt;. A o Meramind wiem od &lt;a href="https://www.youtube.com/watch?v=JiQmpA474BY"&gt;Arjana i jego filmu&lt;/a&gt;.&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="ai_ml"&gt;#AI_ML&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://www.youtube.com/watch?v=ANEJADyAyOE"&gt;&lt;strong&gt;Business Intelligence z Machine Learning&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Zapis ciekawego webinaru łączącego oba wspominane w tytule zagadnienia&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-02-07</title><link>https://blog.prokulski.science/2022/02/07/newsletter-dane-i-analizy-2022-02-07/</link><pubDate>Mon, 07 Feb 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/02/07/newsletter-dane-i-analizy-2022-02-07/</guid><description>&lt;p&gt;Dzisiaj &lt;em&gt;lajtowo&lt;/em&gt;, ale najbardziej polecam coś co mogliście przegapić wczoraj na &lt;a href="https://www.facebook.com/DaneAnalizy/"&gt;fanpage&amp;rsquo;u&lt;/a&gt; - &lt;a href="https://www.youtube.com/watch?v=v68zYyaEmEA"&gt;&lt;strong&gt;wideo&lt;/strong&gt;&lt;/a&gt; o tym jak pomóc sobie grając w Wordle albo raczej jaka matematyka stoi za wyborem kolejnych słów. Jest też &lt;a href="https://github.com/3b1b/videos/blob/master/_2022/wordle.py"&gt;kod w repo&lt;/a&gt;.&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="analiza_danych_projekty"&gt;#analiza_danych_projekty&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://datascienceplus.com/topic-modeling-and-latent-dirichlet-allocation-lda/"&gt;&lt;strong&gt;Topic Modeling and Latent Dirichlet Allocation (LDA)&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;O czym są poszczególne tekstów w zbiorze tekstów? &amp;ldquo;Topic modeling&amp;rdquo; oparty o LDA pozwala to określić, a ten tekst wprowadza w zagadnienie na przykładzie kodu w Pythonie&lt;/p&gt;&#10;&lt;h3 id="big_data"&gt;#big_data&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://engineering.linkedin.com/blog/2022/darwin--data-science-and-artificial-intelligence-workbench-at-li"&gt;&lt;strong&gt;DARWIN: Data Science and Artificial Intelligence Workbench at LinkedIn&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Jak LinkedIn buduje swoją platformę danych i ich analiz?&lt;/p&gt;</description></item></channel></rss>