{
 "url": "https://11d.im/yo/20220318110313/",
 "published": "Fri Mar 18 2022 12:03:13 GMT+0100 (Central European Standard Time)",
 "updated": "Tue Oct 08 2024 00:09:56 GMT+0200 (Central European Summer Time)",
 "author": {
  "name": "tk",
  "url": "https://11d.im"
 },
 "content": "<section>\n<p><a href=\"https://pandas.pydata.org/\">Pandas</a> est une biblioth\u00e8que Python permettant de faire de la manipulation de donn\u00e9es.</p>\n<p>\u00c0 chaque fois que cette biblioth\u00e8que appara\u00eet dans une conversation, un motif qui se r\u00e9p\u00e8te est la difficult\u00e9 d\u2019en faire une comp\u00e9tence et qu\u2019il faut r\u00e9guli\u00e8rement r\u00e9-apprendre \u00e0 l\u2019utiliser. Comme beaucoup, je crois, je n\u2019ai pas eu d\u2019apprentissage formelle de cette biblioth\u00e8que et je l\u2019utilise de fa\u00e7on opportuniste et performative (j\u2019utilise pandas donc je fais de la <em>data science</em>). Je gal\u00e8re toujours quelques minutes \u00e0 me remettre dans l\u2019intentionnalit\u00e9 de la syntaxe et je finis r\u00e9guli\u00e8rement par faire des boucles et des fonctions anonymes en python d\u2019origine.</p>\n<p>La lecture d\u2019<a href=\"https://store.metasnake.com/effective-pandas-book\">effective pandas</a> m\u2019a beaucoup aid\u00e9 \u00e0 remettre au clair comment et pourquoi utiliser pandas. Mon objectif est de ne plus avoir l\u2019impression de me battre contre ces bouts de code et de pouvoir me concentrer sur l\u2019analyse de donn\u00e9es plut\u00f4t qu\u2019avoir l\u2019impression de faire de la programmation autour de donn\u00e9es. Ne plus avoir \u00e0 r\u00e9fl\u00e9chir \u00e0 python ou pandas mais aux donn\u00e9es que je suis entrain de regarder. Pour que cela devienne naturel et intuitif, je suppose qu\u2019il faut donc changer de strat\u00e9gie et passer par un apprentissage cumulatif (sans que cela soit simple ou imm\u00e9diat) plut\u00f4t que de revenir \u00e0 z\u00e9ro r\u00e9guli\u00e8rement.</p>\n<p>Ce que j\u2019en retiens principalement :</p>\n<p>Pandas est organis\u00e9 autour de <em>series</em> et les <em>dataframes</em> ne viennent qu\u2019apr\u00e8s. C\u2019est contre-intuitif car j\u2019ai l\u2019habitude de travailler sur des tableaux et devoir des tableaux. Cela se justifie par une optimisation des calculs et ce qui fait l\u2019inter\u00eat de la biblioth\u00e8que et surtout de son API<label class=\"margin-toggle sidenote-number\" for=\"sn-0\"></label><input class=\"margin-toggle\" id=\"sn-0\" type=\"checkbox\"/><span class=\"sidenote\">La syntaxe, le nom et l\u2019organisation des fonctions etc. Dask et <a href=\"http://pola.rs\">pola.rs</a> sont deux exemples de biblioth\u00e8que utilisant l\u2019API de pandas.</span> : exploiter les calculs vectoriels de numpy. Une approche <em>\u00e0 l\u2019ancienne</em> tend \u00e0 annuler tout l\u2019int\u00e9r\u00eat de l\u2019API. C\u2019est peut \u00eatre \u00e7a qui me frustrait inconsciemment. Le livre passe ainsi beaucoup de temps sur les s\u00e9ries puis recolle les morceaux dans le cadre de la manipulation de dataframes. J\u2019ai l\u2019impression que cela fonctionne plut\u00f4t bien et que les concepts adh\u00e8rent mieux \u00e0 mon cerveau.</p>\n<p>Le <em><a href=\"https://tomaugspurger.github.io/method-chaining.html\">method chaining</a></em> rend le code plus lisible pour soi et les autres et quelque part \u00e9l\u00e9gant. Cela ressemble \u00e0 la mani\u00e8re que j\u2019ai d\u00e9j\u00e0 de faire en javascript \u00e0 cause d\u2019<a href=\"https://observablehq.com/\">observable</a>. Tout cela provient certainement de R. C\u2019est peut-\u00eatre qu\u2019une question de mode.</p>\n<p>Est-ce que le livre vaut le d\u00e9tour et le prix ? Je le saurai sans doute dans quelques ann\u00e9es. En relisant du vieux code et en le r\u00e9crivant, j\u2019\u00e9tais plut\u00f4t content de moi donc il y a aussi un effet imm\u00e9diat quand m\u00eame.</p>\n<p>Il y a un petit dark pattern au moment de l\u2019achat. Au cours de celui-ci, le site propose une r\u00e9duction sur un bundle comprenant plusieurs cours en ligne. J\u2019ai voulu cliquer pour voir si la r\u00e9duction incluait l'achat du pdf mais en fait cela d\u00e9clenche un nouvel achat et quelque part fait acheter le pdf deux fois.</p>\n</section>",
 "content-plain": "Pandas est une biblioth\u00e8que Python permettant de faire de la manipulation de donn\u00e9es.\n\n\u00c0 chaque fois que cette biblioth\u00e8que appara\u00eet dans une conversation, un motif qui se r\u00e9p\u00e8te est la difficult\u00e9 d\u2019en faire une comp\u00e9tence et qu\u2019il faut r\u00e9guli\u00e8rement r\u00e9-apprendre \u00e0 l\u2019utiliser. Comme beaucoup, je crois, je n\u2019ai pas eu d\u2019apprentissage formelle de cette biblioth\u00e8que et je l\u2019utilise de fa\u00e7on opportuniste et performative (j\u2019utilise pandas donc je fais de la data science). Je gal\u00e8re toujours quelques minutes \u00e0 me remettre dans l\u2019intentionnalit\u00e9 de la syntaxe et je finis r\u00e9guli\u00e8rement par faire des boucles et des fonctions anonymes en python d\u2019origine.\n\nLa lecture d\u2019effective pandas m\u2019a beaucoup aid\u00e9 \u00e0 remettre au clair comment et pourquoi utiliser pandas. Mon objectif est de ne plus avoir l\u2019impression de me battre contre ces bouts de code et de pouvoir me concentrer sur l\u2019analyse de donn\u00e9es plut\u00f4t qu\u2019avoir l\u2019impression de faire de la programmation autour de donn\u00e9es. Ne plus avoir \u00e0 r\u00e9fl\u00e9chir \u00e0 python ou pandas mais aux donn\u00e9es que je suis entrain de regarder. Pour que cela devienne naturel et intuitif, je suppose qu\u2019il faut donc changer de strat\u00e9gie et passer par un apprentissage cumulatif (sans que cela soit simple ou imm\u00e9diat) plut\u00f4t que de revenir \u00e0 z\u00e9ro r\u00e9guli\u00e8rement.\n\nCe que j\u2019en retiens principalement :\n\nPandas est organis\u00e9 autour de series et les dataframes ne viennent qu\u2019apr\u00e8s. C\u2019est contre-intuitif car j\u2019ai l\u2019habitude de travailler sur des tableaux et devoir des tableaux. Cela se justifie par une optimisation des calculs et ce qui fait l\u2019inter\u00eat de la biblioth\u00e8que et surtout de son APILa syntaxe, le nom et l\u2019organisation des fonctions etc. Dask et pola.rs sont deux exemples de biblioth\u00e8que utilisant l\u2019API de pandas. : exploiter les calculs vectoriels de numpy. Une approche \u00e0 l\u2019ancienne tend \u00e0 annuler tout l\u2019int\u00e9r\u00eat de l\u2019API. C\u2019est peut \u00eatre \u00e7a qui me frustrait inconsciemment. Le livre passe ainsi beaucoup de temps sur les s\u00e9ries puis recolle les morceaux dans le cadre de la manipulation de dataframes. J\u2019ai l\u2019impression que cela fonctionne plut\u00f4t bien et que les concepts adh\u00e8rent mieux \u00e0 mon cerveau.\n\nLe method chaining rend le code plus lisible pour soi et les autres et quelque part \u00e9l\u00e9gant. Cela ressemble \u00e0 la mani\u00e8re que j\u2019ai d\u00e9j\u00e0 de faire en javascript \u00e0 cause d\u2019observable. Tout cela provient certainement de R. C\u2019est peut-\u00eatre qu\u2019une question de mode.\n\nEst-ce que le livre vaut le d\u00e9tour et le prix ? Je le saurai sans doute dans quelques ann\u00e9es. En relisant du vieux code et en le r\u00e9crivant, j\u2019\u00e9tais plut\u00f4t content de moi donc il y a aussi un effet imm\u00e9diat quand m\u00eame.\n\nIl y a un petit dark pattern au moment de l\u2019achat. Au cours de celui-ci, le site propose une r\u00e9duction sur un bundle comprenant plusieurs cours en ligne. J\u2019ai voulu cliquer pour voir si la r\u00e9duction incluait l'achat du pdf mais en fait cela d\u00e9clenche un nouvel achat et quelque part fait acheter le pdf deux fois.",
 "syndication": [],
 "type": "entry",
 "name": "s'am\u00e9liorer en pandas"
}