<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Scraping on Łukasz Prokulski, Dane i Analizy</title><link>https://blog.prokulski.science/tags/scraping/</link><description>Recent content in Scraping on Łukasz Prokulski, Dane i Analizy</description><generator>Hugo</generator><language>pl-PL</language><lastBuildDate>Mon, 16 Dec 2024 15:00:00 +0000</lastBuildDate><atom:link href="https://blog.prokulski.science/tags/scraping/index.xml" rel="self" type="application/rss+xml"/><item><title>Newsletter Dane i Analizy, 2024-12-16</title><link>https://blog.prokulski.science/2024/12/16/newsletter-dane-i-analizy-2024-12-16/</link><pubDate>Mon, 16 Dec 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/12/16/newsletter-dane-i-analizy-2024-12-16/</guid><description>&lt;p&gt;Czego szukali ludzie w Google w mijającym roku? Google dostarcza podsumowanie dla całego świata i większości krajów z osobna (&lt;a href="https://trends.withgoogle.com/year-in-search/2024/pl/"&gt;tutaj Polska&lt;/a&gt;, tutaj &lt;a href="https://trends.withgoogle.com/year-in-search/2024/"&gt;&lt;em&gt;global&lt;/em&gt;&lt;/a&gt;). Podsumowania te są o tyle interesujące, że stanowią pewnego rodzaju obraz naszego społeczeństwa i jego zainteresowań.&lt;/p&gt;&#10;&lt;p&gt;Wiecie, że w Afryce w większości państw ruch w internecie z komórki przeważa ruch z komputerów? W przykładowym Sudanie ponad 77% to komórki. Tego typu rzeczy można dowiedzieć się z corocznego raport &lt;a href="https://radar.cloudflare.com/year-in-review/2024"&gt;Cloudflare Radar&lt;/a&gt;. Raport mówi nie tylko o dominacji Google, ale też zawiera statystyki dotyczące szyfrowania ruchu, popularności różnych technologii sieciowych czy kwestii bezpieczeństwa.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-06-24</title><link>https://blog.prokulski.science/2024/06/24/newsletter-dane-i-analizy-2024-06-24/</link><pubDate>Mon, 24 Jun 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/06/24/newsletter-dane-i-analizy-2024-06-24/</guid><description>&lt;p&gt;W piłkę polska reprezentacja już (za moment) na Euro nie pogra, ale o przewidywaniu wyników trwającego turnieju piłkarskiego coś dzisiaj znajdziecie. Nawet nie w kontekście polskiej reprezentacji, a bardziej w kontekście &amp;ldquo;jak to się robi?&amp;rdquo;. Bo taki cel ma ten newsletter - pokazywać jak to się robi. Więc jeśli znasz kogoś, kto jeszcze nie wie to ślij mu tego maila. A jeśli ktoś przysłał Tobie tego maila - to zapisz się prawilnie na &lt;a href="https://www.subscribepage.com/daneanalizy"&gt;odpowiedniej stronie&lt;/a&gt;.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2024-06-10</title><link>https://blog.prokulski.science/2024/06/10/newsletter-dane-i-analizy-2024-06-10/</link><pubDate>Mon, 10 Jun 2024 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2024/06/10/newsletter-dane-i-analizy-2024-06-10/</guid><description>&lt;p&gt;Dzisiaj dwa ciekawe teksty o technikach OSINTowych - czyli jak z publicznie dostępnych informacji dotrzeć do czegoś więcej. Na przykład do informacji &lt;a href="https://frontstory.pl/penthouse-daniel-obajtek-budapeszt-orlen/"&gt;gdzie ktoś faktycznie jest&lt;/a&gt; (chociaż mówi inaczej) co jest nieco zabawą podobną do serwisu &lt;a href="https://www.geoguessr.com/pl"&gt;GeoGuesser&lt;/a&gt; (interesująca zabawa, zacznij od map ze znanej Ci okolicy) - na przykładzie &lt;a href="https://zaufanatrzeciastrona.pl/post/na-tropie-szmydta-czyli-jak-znalezc-bialoruskiego-szpiega/"&gt;szpiegów&lt;/a&gt;. Może jeszcze na dokładkę coś &lt;a href="https://devszczepaniak.pl/osint-pozyskiwanie-informacji-z-wykorzystaniem-map/"&gt;o szukaniu informacji z wykorzystaniem map&lt;/a&gt;?&lt;br&gt;&#10;Tyle o szukaniu. A o ukrywaniu? No na przykład &lt;a href="https://bishopfox.com/blog/unredacter-tool-never-pixelation"&gt;pikselowanie tekstu&lt;/a&gt; na obrazkach umieszczanych w sieci nie ma większego sensu.&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2022-08-22</title><link>https://blog.prokulski.science/2022/08/22/newsletter-dane-i-analizy-2022-08-22/</link><pubDate>Mon, 22 Aug 2022 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2022/08/22/newsletter-dane-i-analizy-2022-08-22/</guid><description>&lt;p&gt;Czy mniejsza liczba artykułów (nie wiem czy to zauważalne&amp;hellip;) to dla Was lepiej czy gorzej? Przeczytacie w związku z tym więcej (wszystkie?) czy tak samo jak zwykle 2-3, a reszta to nuda?&lt;/p&gt;&#10;&lt;p&gt;Dzisiejszy numer to nieco eksperyment ale - przyznajmy to szczerze - wynik sezonu wakacyjnego. Oj ciężko się zebrać do roboty, ciężko&amp;hellip;&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="ai_ml"&gt;#AI_ML&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://mlu-explain.github.io/"&gt;&lt;strong&gt;MLU-Explain&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Jak działają lasy losowe? Co to jest krzywa ROC i AUC? Jeśli nie wiesz to ten serwis w przystępny, graficzny sposób pomoże to zrozumieć&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-12-27</title><link>https://blog.prokulski.science/2021/12/27/newsletter-dane-i-analizy-2021-12-27/</link><pubDate>Mon, 27 Dec 2021 15:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/12/27/newsletter-dane-i-analizy-2021-12-27/</guid><description>&lt;p&gt;To ostatni numer newslettera&amp;hellip; w tym roku. Czy ten sam dowcip (o ostatnim numerze newslettera) działa dwa razy? Wątpię. Ale dobry suchar po całej masie pierogów, sałatek i ciast może okazać się zbawienny. Tak wiem - jest czerstwo, zatem zgodnie z planem ;-)&lt;/p&gt;&#10;&lt;p&gt;Przed Tobą ostatnia w tym roku dawka interesujących tekstów, nieco skromniejsza niż zwykle, ale liczę na to że również atrakcyjna.&lt;/p&gt;&#10;&lt;hr&gt;&#10;&lt;h3 id="analiza_danych_koncepcje"&gt;#analiza_danych_koncepcje&lt;/h3&gt;&#10;&lt;p&gt;&lt;a href="https://www.analyticsvidhya.com/blog/2015/11/easy-methods-deal-categorical-variables-predictive-modeling/"&gt;&lt;strong&gt;How to Deal With Categorical Variable in Predictive Modeling&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Jak radzić sobie ze zmiennymi kategorycznymi w danych? Kilka przydatnych metod&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-10-18</title><link>https://blog.prokulski.science/2021/10/18/newsletter-dane-i-analizy-2021-10-18/</link><pubDate>Mon, 18 Oct 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/10/18/newsletter-dane-i-analizy-2021-10-18/</guid><description>&lt;p&gt;&lt;a href="https://mihaisplace.blog/2021/10/03/the-state-of-web-scraping-in-2021/"&gt;&lt;strong&gt;The State Of Web Scraping in 2021 – Mihai&amp;rsquo;s Blog&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Author: Mihai Avram | Date: 10/02/2021 The area of web scraping has really expanded in the last few years, and it helps to know some of the main frameworks, protocols, and etiquette so that you can build the next awesome Web Scraping tool to revolutionize our world! Or maybe just your local neighborhood, or workgroup – that’s fine too. In this post, we will cover. What is web scraping? What are (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-07-12</title><link>https://blog.prokulski.science/2021/07/12/newsletter-dane-i-analizy-2021-07-12/</link><pubDate>Mon, 12 Jul 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/07/12/newsletter-dane-i-analizy-2021-07-12/</guid><description>&lt;p&gt;&lt;a href="https://towardsdatascience.com/what-is-mlops-everything-you-must-know-to-get-started-523f2d0b8bd8"&gt;&lt;strong&gt;What is MLOps — Everything You Must Know to Get Started | by Harshit Tyagi&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;A complete walkthrough of ML systems development lifecycle and need for MLOps Until recently, all of us were learning about software development lifecycle(SDLC) and how it goes from requirement elicitation → designing → development → testing → deployment → all the way down to maintenance. We (&amp;hellip;)&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://neptune.ai/blog/vectorization-techniques-in-nlp-guide"&gt;&lt;strong&gt;Vectorization Techniques in NLP [Guide] - neptune.ai&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Natural Language is how we, humans, exchange ideas and opinions. There are two main mediums for natural language – speech and text.  Listening and reading are effortless for a healthy human, but they’re difficult for a machine learning algorithm. That’s why scientists had to come up with Natural (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-07-05</title><link>https://blog.prokulski.science/2021/07/05/newsletter-dane-i-analizy-2021-07-05/</link><pubDate>Mon, 05 Jul 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/07/05/newsletter-dane-i-analizy-2021-07-05/</guid><description>&lt;p&gt;&lt;a href="https://towardsdatascience.com/create-a-dashboard-to-track-anything-with-plotly-and-dash-f9a5234d548b"&gt;&lt;strong&gt;How to Create a Dashboard to Track Anything With Plotly And Dash&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Or “How I stopped using third-party apps to track my investments”! It’s really easy to get started with your own template. Spoiler alert: this is not my actual portfolio! Ever since I started investing my hard-earned money, I was obsessed with having some sort of dashboard or tool that would allow (&amp;hellip;)&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/state-of-the-art-of-speech-synthesis-at-the-end-of-may-2021-6ace4fd512f2"&gt;&lt;strong&gt;State Of The Art of Speech Synthesis at the End of May 2021 | by Patrick Meyer | Jun, 2021&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Thoughts and Theory Presentation of the state of the art in speech synthesis research at the end of May 2021 with a focus on deep learning technologies. I present a synthesis of 71 publications and give you the keys to understand the underlying concepts. Voice is the most natural way we have to (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Newsletter Dane i Analizy, 2021-06-21</title><link>https://blog.prokulski.science/2021/06/21/newsletter-dane-i-analizy-2021-06-21/</link><pubDate>Mon, 21 Jun 2021 09:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2021/06/21/newsletter-dane-i-analizy-2021-06-21/</guid><description>&lt;p&gt;&lt;a href="https://jellyfish.tech/implementation-of-common-design-patterns-in-python/"&gt;&lt;strong&gt;Implementation of Top Design Patterns in Python&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;*according to developer &amp;amp; software architect with 9+ years of experience&lt;/p&gt;&#10;&lt;p&gt;&lt;a href="https://towardsdatascience.com/a-hands-on-demo-of-analyzing-big-data-with-spark-68cb6600a295?source=rss----7f60cf5620c9---4"&gt;&lt;strong&gt;A hands-on demo of analyzing big data with Spark&lt;/strong&gt;&lt;/a&gt;&lt;br&gt;&#10;Scan a novel, calculate pi, and run regression on 50 million rows Conclusions This post was a deep dive on using Spark to process big data. We started with an overview of distributed computing before counting the frequency of each letter in Dostoyevsky’s War and Peace , estimating π with randomly (&amp;hellip;)&lt;/p&gt;</description></item><item><title>Wywiad dla podcastu "Biznes Myśli"</title><link>https://blog.prokulski.science/2020/01/06/biznes-mysli/</link><pubDate>Mon, 06 Jan 2020 17:00:00 +0000</pubDate><guid>https://blog.prokulski.science/2020/01/06/biznes-mysli/</guid><description>&lt;p&gt;Tuż przed końcem roku miałem przyjemność porozmawiać z Valdimirem na temat danych, ich analizy i wizualizacji.&lt;/p&gt;&#10;&lt;p&gt;&lt;img src="../../downloads/2020/01/BM73.jpg" alt=""&gt;&lt;/p&gt;&#10;&lt;h4 id="podczas-rozmowy-mówiłem-między-innymi-o"&gt;Podczas rozmowy mówiłem między innymi o:&lt;/h4&gt;&#10;&lt;ul&gt;&#10;&lt;li&gt;Kiedy możemy mówić, że dane są dobrej, a kiedy złej jakości&lt;/li&gt;&#10;&lt;li&gt;Co można zrobić, aby dane były dobrej jakości&lt;/li&gt;&#10;&lt;li&gt;Czym jest scrapowanie danych, kiedy można spróbować, kiedy lepiej unikać&lt;/li&gt;&#10;&lt;li&gt;Jak wizualizować dane, aby były jednoznacznie czytelne&lt;/li&gt;&#10;&lt;li&gt;​Jak nie dać się oszukać przez dane i jak unikać nieświadomego przekłamywania danych&lt;/li&gt;&#10;&lt;li&gt;Jak powinien wyglądać dostęp do danych w idealnym świecie&lt;/li&gt;&#10;&lt;/ul&gt;&#10;&lt;hr&gt;&#10;&lt;p&gt;&lt;a href="https://biznesmysli.pl/lukasz-prokulski-dane-i-analizy/"&gt;&lt;strong&gt;Tutaj&lt;/strong&gt;&lt;/a&gt; znajdziecie transkrypcję nagrania, a samo nagranie poniżej:&lt;/p&gt;</description></item></channel></rss>