Doctolib fait de la "recherche"

Jeudi 3 septembre 2026 - Permalien

Le formulaire pour sortir de la collecte de données se trouve ici !




C'est un belge, un allemand et un suisse qui sont dans un avion.

Attends. J'en ai une mieux !

C'est Doctolib, les données personnelles et de santé de tous les français et des générateurs de contenus artificiels qui sont dans un bateau : hé bah, vivement que le bateau coule !

Tu as peut-être raté l'info mais si c'est le cas ne t'inquiète pas, c'est volontaire : Doctolib a profité de la période estivale pour annoncer qu'ils allaient effectuer des "recherches en santé".

Bon, en gros, ce qu'ils appellent de la recherche en santé moi j'appelle ça du développement interne. Oui ils vont travailler avec des organismes de recherche (INRIA, INSERM et université Paris Cité) mais la finalité des deux études qu'ils viennent de lancer, c'est quoi ?

  • Etudier comment des outils d’intelligence artificielle générateurs de contenus artificiels peuvent aider à mieux anticiper certains risques à partir de l’historique médical, afin de mieux organiser et coordonner les parcours de soins.
  • Étudier comment obtenir des mesures fiables du niveau de confiance des modèles génératifs utilisés dans le domaine médical, afin de contribuer à la sécurité des utilisateurs.

Il suffit de consulter la page consacrée à leur laboratoire de recherche en "IA" et la présentation de quelques membres de l'équipe pour se rendre compte que cette putain de collecte massive de données va servir à développer des générateurs de contenus artificiels en interne.

Le simple fait qu'une plateforme comme Doctolib soit gérée par une entreprise privée et pas par un service public, c'est déjà un scandale.

Deuxième scandale, Doctolib s'est passé de l'autorisation des utilisateurs en invoquant l'intérêt légitime du traitement des données. Il s'agit effectivement d'une clause du RGPD mais qu'on soit bien clairs : dans le texte de loi, quand on parle d'intérêt légitime, on se pose la question de savoir si l'exploitation des données est légitime, on n'est pas en train de dire que cette exploitation va présenter un intérêt pour la personne qui vient de se faire plumer (article 6.1.f).

Je ne m'attarderai pas sur la débilité de vouloir déployer des intelligences artificielles générateurs de contenus artificiels dans un domaine sensible : les hallucinations sont inhérentes aux LLM, ça a été démontré mathématiquement il y a déjà plusieurs années et même sur une tâche aussi simple qu'un résumé de texte on est encore à 5% d'hallucinations en moyenne. Pour des questions ouvertes, le taux varie entre 15% et 30% :


source

source

D'après la communication de Doctolib, tous les utilisateurs ou presque sont concernés (patients majeurs, utilisateurs des services personnalisés, utilisateurs du Compagnon de santé et leurs proches mineurs). Les données sont collectées via le logiciel praticien (y compris l’assistant de consultation), les services personnalisés (aucune idée de ce que c'est) et le Compagnon de santé (application smartphone).

Les données utilisées sont :

  • Les données de santé. J'imagine qu'une prescription, un résultat de dépistage ou une image médicale sont évidemment des données de santé.
  • Les données d’habitude de vie. Ça, c'est tout ce que tu racontes à ton médecin en plus du problème spécifique pour lequel tu es venu le voir et c'est surtout toutes les putains d'informations que leur application fait remonter. Rien qu'avec une position GPS il est très simple de savoir, pour chaque utilisateur, la fréquence et la durée de passage dans des lieux qui représentent des points d'intérêt importants pour un "suivi de santé" (restaurants, bars, fast food, bureaux de tabac, salle de sport, piscine, nature, etc, etc, etc). Zéro lubrifiant mais ce genre de suivi est infiniment plus intrusif qu'une coloscopie. Et bien entendu, l'application ne se contente pas de la position GPS1.
  • Les données démographiques.

Si tu as raté leur e-mail pendant que tu sirotais un verre avec tes potes cet été, il est un peu tard mais il n'est pas trop tard pour s'y opposer. Il suffit de remplir ce formulaire pour empêcher l'utilisation de toute donnée personnelle récoltée après la validation dudit formulaire. Si tu as pensé à remplir ce formulaire avant le mois d'août, bien joué, aucune de tes données personnelles ou de santé n'iront alimenter le générateur de contenus artificiel de Doctolib.




1 : Non mais sérieux. À quel moment une application médicale à besoin d'accéder à tes photos, tes vidéos et à l'intrégralité des fichiers que tu as stocké sur ton téléphone ? On appréciera aussi les quelques données qui sont collectées dans le but d'être revendues (bien évidemment la position GPS en fait partie).

La liberté selon Free

Mercredi 02 septembre 2026 - Permalien

Chez Free, "sans engagement" ça veut dire qu'on a le droit de payer plus cher si on veut.

Bien joué les gars, 20/20 en filsdeputerie.




Renouveler des certificats avec certbot

Vendredi 14 août 2026 - Permalien

Je viens de renouveler les certificats SSL de ce site, l'occasion de faire un petit pense-bête :

  • S'assurer que les ports sont ouverts pour permettre des connexion https ET http.
  • Certbot permet de tester le renouvellement avant de vraiment appliquer des modifications au serveur. Exécuter cette commande et vérifier qu'il n'y a pas de message d'erreur :
    sudo certbot renew --cert-name argonautes.net --apache --dry-run
  • Si la commande précédente s'est exécutée avec succès, on peut maintenant réellement renouveler les certificats :
    sudo certbot renew --cert-name argonautes.net --apache
  • Reconfigurer les ports si nécessaire (chez moi par exemple, les connexions http sont entièrement bloquées).

En bonus, voilà deux petites commandes qui peuvent servir :

  • Lister tous les certificats installés sur la machine :
    sudo certbot certificates
  • Tester la configuration d'apache2 :
    sudo apachectl configtest

On en est où de l'IA ?

Lundi 1er juin 2026 - Permalien

Dans le monde financier, on en est là : suite aux différents tours de table organisés pour collecter des fonds, la capitalisation d'OpenAI s'élève à 852 milliards de dollars. Ils espèrent dépasser les 1 000 milliards suite à leur entrée en bourse. 1 000 milliards, c'est un million de millions. Largement de quoi faire perdre son vocabulaire au capitaine Hadock, mille million de mille sabords ! Antropic, le concurent d'OpenAi, en est au même point.

J'ai épluché mon historique de navigation sur les 2 ou 3 semaines passées pour fournir une liste d'articles qui donnent peut-être une meilleure idée de là où en est dans la vraie vie (j'ai fouillé plus loin pour retrouver les articles en lien avec les réacteurs nucléaires ou le charbon, ces actualités sont parfois vielle d'un an et demi).

Ma volonté n'est pas de dire que ces intelligences artificielles générateurs de contenus artificiels ne servent absolument à rien, il y aura forcément des domaines d'utilisation pertinents comme la surveillance de masse, la génération de propagande de masse ou la génération de faux documents en masse (oui je suis taquin mais quand ça fait 3 ans qu'on bouffe de la propagande destinée à vendre un produit de merde, y'a un moment où ça énerve).

Il faut bien garder en tête qu'en plus de l'utilisation discutable de l'outil, celui-ci est pour l'instant offert au client ou facturé à un prix dérisoir (principe du dealer qui offre les premières doses pour rendre ses clients accros). Il y a bien un moment où les investisseurs vont vouloir récupérer leurs 1000 milliards, et là, ça va vraiment faire mal. Quand on ajoute les consommations massives de ressources et la nullité globale du produit relativement aux performances incroyables que les lobbyistes ont vanté pendant 3 ans, la balance penche difficilement vers une rentabilité de ces intelligences artificielles générateurs de contenus artificiels :

Sauvegarder les vidéos trouvées sur internet

Mardi 26 mai 2026 - Permalien

L'utilitaire yt-dlp permet de sauvergarder facilement les vidéos hébergées sur des sites comme Youtube, Arte, CBS ou Instagram. La liste complète des sites supportés se trouve ici (plus de 1800).

yt-dlp est écrit en python, il est donc compatible Linux, MacOS et Windows. Pour installer yt-dlp sous Linux, rien de plus simple, il suffit de suivre les instructions en copiant/collant ces trois lignes dans le terminal :

  • sudo add-apt-repository ppa:tomtomtom/yt-dlp
  • sudo apt update
  • sudo apt install yt-dlp

Voilà quelques exemples d'utilisation :

  • Télécharger une vidéo :
    • yt-dlp https://www.youtube.com/watch?v=Jtmo3T98eQw
  • Télécharger toute une playlist :
    • yt-dlp https://www.youtube.com/playlist?list=PLhJvo3IHUgTOgPP9-kaoR-SzgUj4mHzyo
  • Télécharger une vidéo avec les sous-titres :
    • yt-dlp https://www.arte.tv/fr/videos/120853-001-A/les-soldats-francais-du-reich-1-2/ --write-subs --sub-langs all
  • Afficher la liste des formats vidéo et audio disponibles pour une vidéo donnée :
    • yt-dlp https://www.youtube.com/watch?v=EOzZgdkJtGI -F
  • Télécharger une vidéo en spécifiant quels formats utiliser (d'après la liste obtenue avec la commande précédente). Pratique pour forcer la sauvergarde en haute définition ou au contraire, en faible définition :
    • yt-dlp https://www.youtube.com/watch?v=EOzZgdkJtGI -f 137+140
  • Télécharger une playlist mais en ne prenant en compte que les fichiers qui ont été publiés après une certaine date tout en choisissant le format des noms de ficihers pour qu'ils soient présentés dans l'ordre chronologique :
    • yt-dlp https://www.youtube.com/@yesvousaime549 -o "%(upload_date)s - %(title)s.%(ext)s" --dateafter 20201129

Pour ceux qui préfèrent, il y a des interfaces graphiques mais je les ai jamais utilisées donc je peux pas vous donner plus d'infos. Pour ceux qui veulent se lancer dans la ligne de commande, la documentation est là. On peut faire bien plus spécifique ou complexe que les quelques exemples que j'ai donné.

Les développeurs de yt-dlp jouent au chat et à la souris avec les sites qui hébergent les vidéos. Il est fortement recommandé d'utiliser la dernière version de yt-dlp pour un maximum de compatibilité avec les sites hébergeurs.

Little Caesars vient d’entrer dans l’« histoire » avec la livraison de pizzas par drone

Mercredi 13 mai 2026 - Permalien

Little Caesars vient d’entrer dans l’« histoire » avec la livraison de pizzas par drone

Putain, ça va vraiment se produire. À grande échelle ? On peut laisser courir son imagination puisqu'apparemment Amazon est également sur le coup.

Ou alors ça va faire plouf après les premières rafales de vent et les premiers crash en centre ville ?

On va vraiment faire tout ce qu'on peut pour cramer nos ressources inutilement jusqu'au bout du bout du capitalisme, on n'arrivera pas à stopper la machine.

Entre cet hypothétique essaim de drones livreurs et les 10 000 drones kamikazes lancés quotidiennement par la Russie et l’Ukraine, on espère une éclaircie. Adieu champs de blés, bonjour champs de lithium et de fibres optiques.

La fabuleuse histoire de l'argent

Mercredi 25 mars 2026 - Permalien

Voilà un nouveau documentaire d'Arte en 4 parties. Du royaume de Lydie à la bourse de New-York, ce documentaire retrace l'histoire de la monnaie. Quelles formes la monnaie a-t-elle pris au cours du temps et pourquoi ? Quelles raisons ont poussé certains royaumes à en accumuler ou à en forcer l'adoption ? Quelle sont les transitions importantes de notre histoire qui sont intimement liées à l'utilisation de la monnaie ?

Copie de sauvegarde des vidéos (avec les sous-titres).

Les dessins de Flock

Lundi 09 mars 2026 - Permalien

Flock, c'est l'illustrateur du journal numérique Next. La plupart des illustrations sont réservées aux abonnés, je peux pas résister au plaisir de vous en faire profiter :



YGG piraté, torrents libérés

04 mars 2026 - Permalien

L'un des plus gros tracker de torrents privé français a été piraté. La cupidité des administrateurs avait fait naître pas mal de critiques au cours des derniers mois et l'ironie voulait qu'un service de téléchargement illégal fasse les poches de ses utilisateurs de façon de plus en plus agressive.

Les détails (techniques et croustillants) du piratage sont ici.

Les torrents ont été remis en liberté. Ils sont accessibles à tous sur des trackers publics, sans quotas ni autres restrictions. La base se trouve là, 100% en liens magnet.

Un tireur sportif agressé chez lui à Villeurbanne, neuf armes et 1 300 cartouches dérobées

Mardi 30 décembre 2025 - Permalien

Ces faits surviennent après le piratage des données personnelles de centaines de milliers d'adhérents de la Fédération française de tir, et qui ont été utilisées notamment "pour commettre des vols par effraction".

Ça fait 20 ans que je prêche dans le désert en essayant de faire comprendre que les données personnelles ont une importance capitale – vitale ! – et que les disséminer partout c'est extrêmement dangereux (mutation de l'état en état policier, arnaques, chantage, perte de vie privée, majoration tarifaire de ton assurance suivant tes habitudes de vie, etc, etc).

Outre le fait que les publicitaires et les assureurs s'arrachent tes données personnelles puisque 4000 courtiers en données personnelles se partagent un gâteau de 200 milliards d'euros par an, les fuites de données sont de plus en plus nombreuses et vont avoir un impact de plus en plus fort sur nos vies.

Alors oui, quand un prestataire se fait pirater et que nos données se retrouvent dans la nature on n'y peut pas grand chose. Mais tiens-toi le pour dit : smartphones, cartes de fidélité, cloud, abonnements, réseaux sociaux, objets connectés, assistants ou utilisation de services non essentiels sont les prochaines armes qui se retourneront contre nous.

Je te l'accorde, dans cette actualité, le contexte est un peu particulier puisque c'est la fédération française de tir qui a été piratée mais à ton avis, parmi le million d'adresses postales qui ont été récupérées, les voleurs sont tombés sur ce butin par hasard ?

N'aie aucun doute sur le fait que l'utilisation de services qui te semblent aussi anodins que l'écoute de musique en ligne ou l'utilisation d'un GPS qui collecte tes informations de géolocalisation permettent de dresser un profil psychologique et d'établir les habitudes de vie de chacun des utilisateurs.