Misc a écrit 6677 commentaires

  • [^] # Re: Calculs de coin de table

    Posté par  (site web personnel) . En réponse au lien Agriculture et nappes phréatiques - En moyenne 1 300m3 d'eau s'évapore de la bassine de Sainte Soline chaque jour, consommation journalière d'une ville de.... Évalué à 3 (+0/-0).

    Je t'invite à utiliser les dimensions de la dite bassine dans le calculateur :

    Je pense qu'on devrait aller inspecter sur place et constater le niveau de l'eau en planque dans la piscine.

  • # En parlant de Clacton-on-Sea et de Linuxfr

    Posté par  (site web personnel) . En réponse au journal Non, Netanyahou, la BD "Panique à Londres" n'est pas un documentaire sur l'érection de la République Islamique de Grande-Bretagne 🙄. Évalué à 6 (+3/-0).

    Saviez vous qu'il y avait un autre candidat avec des soucis avec la justice dans cette éléction ?

    Alors non, je ne parle pas de Laurence Fox, mais de Daniel Pocock, ancien développeur Debian déchu, tristement connu pour la campagne de harcèlement qu'il a commencé il y a bientôt 10 ans. C'est la deuxième fois qu'il tente de se faire élire à un mandat, la première fois étant en 2024. Ce fut l'occasion pour lui de battre un record, celui d'avoir le moins de voix toutes élections confondues sur cette circonscription (524 votants sur 1.3 millions d’électeurs, donc 0.04%). Ce coup ci, il n'a pas fini dernier, mais en ayant 16 votes sur les 79785 personnes inscrites sur les listes, il passe à 0.02%, c'est un peu la déchéance de faire un score moitié moins bon.

    Pourquoi est ce qu'il se présente, je ne sais pas, mais je suppose que quand on a des dettes (50 000€ pour la compagnie d’électricité d’après son propre blog) et sans doute d'autres soucis, l'immunité parlementaire doit avoir un peu plus d'importance.

  • [^] # Re: Dissuasif⁉️ 🤣

    Posté par  (site web personnel) . En réponse au lien Démarchage téléphonique : à partir du 11 août, les entreprises devront obtenir le consentement des consommateurs. Évalué à 3 (+0/-0).

    Saracroche maintient à jour une BdD des numéros repérés comme spammeurs par les usagers. Et donc en dehors des numéros obligatoires. Et il peut aussi agir sur les SMS.

    Alors j'ai pas Saracroche, mon tel est trop vieux, mais sur yet another call blocker (l'appli que j'utilise), je vois bien que la majorité des appels bloqués le sont parce qu'ils sont dans la liste noire que j'ai rentré sous le nom "bloc arcep" (avec les indicatifs que l'arcep documente). Sur la liste des appels depuis le début de l'année, il y a eu entre 90 et 100 appels bloqués, et je pense qu'il y a moins de 5 numéros qui sont peut être du spam et qui n'ont pas été bloqué. Je ne suis pas sur parce que je regarde juste les appels hors du carnet d'adresse de moins d'une minute, et c'est pas parce que c'est court que c'était un spam. Donc ça fait entre 0 et 5% qui passent entre les filets, je pense que ça pointe en direction d'un impact indéniable de la loi, et un respect des obligations par une vaste majorité des acteurs de la chaîne.

  • [^] # Re: Signal

    Posté par  (site web personnel) . En réponse au lien Résolution de la rentrée : quitter WhatsApp. Évalué à 9 (+6/-0).

    Le problème de xmpp, c'est que personne ne sponsorise un ou plusieurs serveurs pour fournir un service pour le monde entier. Whatsapp, 3 milliard d'usager par mois, c'est 2000 fois plus que le fediverse. Et déjà là, c'est concentré sur quelques gros serveurs et il y a régulièrement des serveurs qui ferment. C'est comme le mail, ou les forges. On arrive à faire des trucs à une échelle assez petite, mais assez clairement, pas à l'échelle du monde.

  • [^] # Re: Pensée systémique.

    Posté par  (site web personnel) . En réponse au lien L’arnaque du bilan carbone. Évalué à 5 (+2/-0).

    Heu juste pour dire que je ne fais pas référence au PIB dans ce que je disais, mais je parlais de la croissance d'une économie dans son ensemble.

    Oui, et de toute façon, réduire un système complexe à un chiffre est une très grosse simplification et une erreur (tout comme réduire une position politique à un angle dans une assemblé, angle lui même réduit à 4/5 positions).

  • [^] # Re: Dissuasif⁉️ 🤣

    Posté par  (site web personnel) . En réponse au lien Démarchage téléphonique : à partir du 11 août, les entreprises devront obtenir le consentement des consommateurs. Évalué à 4 (+1/-0).

    A mon avis vu l'ampleur, tant qu'un paquet d'amendes ne sera pas tombé, ça ne changera rien.

    En même temps, personne ne semble se plaindre, ou pas assez de monde.

    Alors laissez vos bloqueurs (type Saracroche et Cie) actifs car sinon ça va s'engouffrer chez vous!

    Saracroche s'appuie aussi sur le fait qu'il y a une obligation d'utiliser des ranges spécifiques de numéros, donc je vois pas pourquoi une certaine obligation marche (celle qui permet d'avoir saracroche), et pourquoi une autre ne marcherais pas.

  • [^] # Re: Modération

    Posté par  (site web personnel) . En réponse au journal Rachat d'Electronic Arts finalisé. Évalué à 3 (+0/-0).

    Je pense que c'est pas tant la religion en tant que pratique, mais la religion en tant que vecteur de pouvoir (d'autant que la religion a du succès, pas grand monde va raler sur le culte de Zeus comme oppression de nos jours). On pourrait dire pareil des idéologies diverses et variées comme par exemple le communisme (exemple typique), mais aussi le nationalisme qui a commencé surtout comme idée de libération contre la royauté avant de prendre les connotations qu'on connaît. Et c'est inextricable car faire changer les choses (ce qui est le but de pas mal d'idéologies ou de mouvements), c'est avant tout essayer (et réussir) d'exercer un pouvoir dans un sens qu'on estime juste. Mais estimer ce qui est "juste" est assez casse gueule, car ce qui parait juste pour un groupe ne va pas l'être pour un autre.

  • [^] # Re: Modération

    Posté par  (site web personnel) . En réponse au journal Rachat d'Electronic Arts finalisé. Évalué à 3 (+0/-0).

    Franchement, c'est petit joueur par rapport à nous.

    (quoi, ma remarque est sarcastique et commente sur la nature humaine et l'incapacité à s'entendre à 100% quand il y a assez de monde, non, pas mon genre…)

  • [^] # Re: Je n'ai pas accroché

    Posté par  (site web personnel) . En réponse au journal Jujutsu v0.44.0. Évalué à 5 (+2/-0).

    Pareil, j'ai pas accroché. J'ai tenté sur un projet solo pour voir la syntaxe (donc git push sur main en direct), mais ça m'a vachement perturbé au final. Je retenterais sans doute dans 6 mois parce que je suis pas immunisé à la propagande, mais j'ai pas trop vu d'avantage dans le workflow d'un projet solo, voir c'était même plus chiant de devoir faire 2 commandes au lieu d'une pour pousser dans main. Et j'arrive déjà à faire des git rebase -i donc même si c'est plus simple avec jj, je n'en bénéficie pas trop.

  • [^] # Re: Pour rappel

    Posté par  (site web personnel) . En réponse au lien Amazon fait construire au Texas la plus grande centrale à gaz des Etats-Unis pour alimenter ses centres de données. Évalué à 1 (+0/-2).

    Ah oui, parce que le capitalisme existe en dehors de la société.

    Si AWS fait un DC, c'est pas juste pour polluer pour le fun parce que c'est pas un super vilain de Captain Planet. Le DC reflète une demande, et la demande vient bien de quelque part. Bien sur que les efforts d'une personne ne vont rien changer face au compte d'une infrastructure qui reflète la demande de plusieurs millions d'autres personnes.

    À part chercher à se dédouaner d'un probléme collectif parce qu'on ne veut rien changer, ce genre de commentaire sert à rien.

  • [^] # Re: Pour rappel

    Posté par  (site web personnel) . En réponse au lien Amazon fait construire au Texas la plus grande centrale à gaz des Etats-Unis pour alimenter ses centres de données. Évalué à 5 (+2/-0).

    En supposant une erreur dans les temps (passage de kwh en kw par an), ça fait une différence de 8000 sur les chiffres, ce qui change bien sur totalement ma conclusion.

    Maintenant, le souci aussi, c est l'usage de gaz que je suppose naturel, car c'est un facteur 30 à 100 par rapport à du nucléaire, et 4 à 8 fois plus que du biomethane (vu la population de bovins au Texas, même si ça produit du co²).

    Enfin bref, si vous êtes client AWS, il est sans doute temps de contacter votre attaché commercial pour foutre un peu de pression (sauf si je me suis planté encore sur les calculs, mon estomac est toujours vide).

  • [^] # Re: Pour rappel

    Posté par  (site web personnel) . En réponse au lien Amazon fait construire au Texas la plus grande centrale à gaz des Etats-Unis pour alimenter ses centres de données. Évalué à 2 (+0/-1).

    Bon, malgré mes recalculs, je me demande si je me suis pas planté sur les unités de temps. Si quelqu'un sans l'estomac vide peut revérifier la concordance des unités, ça serait sympa.

  • # Pour rappel

    Posté par  (site web personnel) . En réponse au lien Amazon fait construire au Texas la plus grande centrale à gaz des Etats-Unis pour alimenter ses centres de données. Évalué à 5 (+3/-1).

    On estime à 9 tonnes par personne et par an les émissions de CO² de la population française. On devrait ramener ça à 2 tonnes pour limiter le changement climatique (principalement via la viande rouge, le fait de prendre drastiquement moins l'avion, et moins d'achat de trucs neufs, je vous laisse jouer avec le graphique).

    La, on a une centrale qui a un permis de consommer jusqu'à 30 millions de tonnes par an soit l'équivalent grosso modo des émissions de la population de Paris intramuros (2.1 millions d'habitant) et celle de Marseille (800 000) combinés, en supposant une conso moyenne de 9 tonnes.

    En pratique, c'est une limite maximum et le permis parle de production de 7.65 GWh. Si on estime que le gaz produit 490 g de CO² par KWh (cf ce document qui cite le GIEC), la production de 7 650 000 KWh via du gaz va produire 3.7 milliards de gramme de CO², soit 3700 t de CO² (7 650 000 * 490, 1 tonne = 1 milliard de gramme), si je ne me suis pas trompé dans les calculs bien sur (si je me suis planté, le reste de mon commentaire serait bien sur incorrect et je me rétracterais devant des chiffres corrigés).

    On est très loin de la limite du permis, et j'ai l'impression que le discours présente la limite comme étant la conso en pratique (exemple ici), ce qui me semble factuellement incorrect et manipulatoire, même si je trouve le permis beaucoup trop permissif à ce niveau (mais bon, le Texas, etc).

    3700 tonnes de CO² par an, c'est pas rien, mais à 1.2 tonnes par personne et par vol transatlantique (A/R), avec 200 personnes par vol, c'est l'équivalent de la production d'une quinzaine d'avion qui font un Paris-New York (240 tonnes par vol), soit grosso modo le trafic sur cette ligne depuis CDG par jour (j'ai compté 15 vols dans une semaine, avec JFK et Newark).

    Donc, si je ne me suis pas trompé dans les calculs, je pense qu'il ne faut pas oublier les leviers les plus impactants vis à vis du changement climatique (à savoir l'avion, la viande rouge, et remplacer trop souvent son matos électronique ou pas). Par refus du complotisme, je n'irais pas jusqu'à dire que certaines industries bénéficient de la distraction qu'entraîne le focus sur le CO² des datacenters, mais ça tomberais quand même à point nommé si ç’était le cas.

  • [^] # Re: Ça vous sert à quoi au quotidien ?

    Posté par  (site web personnel) . En réponse au journal Auto-héberger ses LLM (IA) : Débordement CPU+RAM, Mixture-of-Experts et Benchmarks. Évalué à 4 (+1/-0).

    Alors si il y a une mauvaise utilisation de l'IA c'est bien ça. Wikipedia te le dis de manière certaine et surtout à jour (ça bouge les capitales !).

    Bien sur, mais si je tape la demande sur Google ou DDG, et qu'une vignette s'affiche avec le résultat, et est ce que j'ai demandé à une IA si je ne vais pas sur Wikipedia ?

    Et je suis d'accord que pour mon exemple qui marche parfaitement, c'est aussi un cas trivial ou ça marche sans LLM (et quand je déploie des modéles, j'envoie toujours 2/3 questions qui semblent trivial mais qui ne le sont pas, comme la durée de train Paris vers New York…). Mais je pense qu'il y a sans doute des demandes plus complexes qui ne vont pas sur WP directement pour illustrer le pouvoir du pattern matching.

    Tu demandes un contenu éditorialisé

    Certes, mais quand je demande ça sur un moteur de recherche, j'ai plus de choix, par fonctionnement d'un moteur de recherche. Et ce point sur le contenu éditorialisé est en fait important.

    donc c'est difficile de reprocher à chacune de pas être celle que tu attendais

    Nan, c'est pas difficile du tout, je viens de le faire :P
    Mais mon point, c'était surtout qu'on peut pas faire confiance assez rapidement, donc prendre 3h pour un truc qui semble prendre 5 minutes me semble une simplification.

    Pour le code (la question c'était "au quotidien", moi c'est le code) les hallucinations il n'y en a quasiment pas dès lors que tu utilises un agent (et pas 3 copier/coller sur le web).

    Mais ça pose la question des biais. Un agent, c'est juste l'automatisation de la vérification des résultats. On va battre les hallucinations par le pouvoir des stats et une boucle (boucle qui au passage devrait être en logiciel libre, mais curieusement un point absent des discussions en général), en gros, ça bruteforce (une approche valable, je précise).

    Mais si il y a des biais dans une demande que tu qualifie d'éditorial comment ça se manifeste dans le code ?

    Je précise que je dit "qualifie d'éditorial" parce je suis d'accord avec toi, mais je ne trouve pas de meilleur mot, et j'ai le sentiment qu'il y en a un.

    On force la forme que prends le code via l'usage des linters, on force le code à être correct via des tests et un compilo (quand c'est possible), et ça n'est pas un processus créatif ou éditorial, mais est ce qu'il y a plus que ça qui rentrerait dans la catégorie "editorial", et est ce que c'est important ?

    Pour répondre à la seconde question, je pense que c'est important.

    Vu que la protection via les droits d'auteurs du code dépend du fait qu'il y a un élément créatif (cf cette article), si on estime que le code produit n'est pas comparable au résultat d'une demande "éditorial", alors même si un humain sélectionne le code, on peut argumenter qu'il n'y rien de créatif, donc rien de protégeable (avec tout ce que ça implique).

    Si au contraire, on estime que l'humain qui va examiner ce que produit le LLM est capable de faire un choix éditorial, alors ça veut dire que le code produit par les LLMs souffre de biais comme le programme des cinés clubs produit par un LLM.

    Et donc, si on estime qu'il y a des biais, comment ça se manifeste dans le code en pratique ?

    (question ouverte, j'ai pas assez réfléchi pour avoir un avis, et on m'a filé un angine ce weekend)

  • [^] # Re: Ça vous sert à quoi au quotidien ?

    Posté par  (site web personnel) . En réponse au journal Auto-héberger ses LLM (IA) : Débordement CPU+RAM, Mixture-of-Experts et Benchmarks. Évalué à 4 (+2/-1).

    la révolution elle est déjà là. pas pour les défis de l'humanité (j'y crois pas une seule seconde), mais pour énormément de métiers. pas forcément une bonne révolution (seul le temps nous le dira), mais dès aujourd'hui, passer 3h à chercher ce qu'une IA peux te pointer du doigt en 5mn, c'est très mal vu en général.

    Le souci, c'est que toutes les recherches ne sont pas égales (premier souci), et que les réponses ne sont pas toujours exhaustives (second souci), et que ça dérive (troisieme souci). Quand il s'agit d'un fait facile à vérifier, je pense que ça va. Par exemple, quelle est la capitale de la Mongolie, ça devrait aller.

    Quand c'est sur un sujet moins présent dans le corpus (soit parce que c'est trop neuf, soit parce que c'est un sujet peu exploré), les risques d'halluciner augmentent. Par exemple, je suis sur que demander un résumé sur les lois autour du droit d'auteur en Afrique du Sud va donner un truc qui semble correct, mais qui va pas rentrer trop dans les détails, car les autres pays dominent sans doute le corpus, et les lois se ressemblent beaucoup. Mais peut être qu'il y a des documents et je suis pas tombé dessus.

    Pour la dérive et les hallucinations, c'est facile à voir.

    Par exemple, j'ai demandé une liste de films en abusant de Gemini de mon employeur (littéralement "j'ai besoin d'un liste de 10 films parlant de la GPA en vue d'organiser une rétrospective pour un club ciné."). Au début, je me suis planté, j'ai mis "PMA" au lieu de "GPA" et "Pro" au lieu de "Flash", et ça tourne encore.

    J'ai pris ça parce que j'ai une idée assez précise des films sur le sujet sorti en France. J'avais en tête La Petite, il est pas dans la liste (ou La Fête des pères. Par contre, la réponse contient Gestación qui ne parle pas de GPA.

    Donc hop, 10% d'hallucination.

    J'ai refait une demande de ciné club sur un autre sujet (la bisexualité masculine au cinéma), la réponse est un chouia plus correct car il y a moins de films dans ma demande (6 au lieu de 10) et il y a plus de listes sur le web.

    Par contre, j'ai aussi demandé des films en français, et dans la liste, il y a Cabaret (1972) qui est non dispo en streaming d'après allociné, et dont le dvd n'a pas de doublage français (vu que c'est une comédie musicale, c'est sans doute trop cher à doubler).

    Encore une fois, j'ai du vérifier pour trouver ce qui va pas.

    Et ça, c'est sans parler des autres soucis. Par exemple, la recherche est partie sans demander plus de détails (contrairement à un humain). J'ai eu plus qu'une liste à chaque fois (avec des explications, le titre du ciné club, les sujets à aborder, etc). J'ai eu des refs sans rapport avec les affirmations auquel elles sont attachés (vu que j'ai eu 6 fois le même article sur medium, qui ne parle que de la moitié des films de la liste…). Et à la fin, le système m'incite à continuer à utiliser Gemini en proposant d'autres requêtes, comme "faire les fiches du ciné club" ou "trouver des trucs plus expérimentaux ou plus anciens" (comprendre, avant les années 80…).

    Pour le fun, j'ai cliqué sur le second, et la, le modèle s'éloigne en proposant Un chant d'amour, de Genet, qui est en effet ancien et plus expérimental, mais qui dérive du sujet de la bisexualité masculine.

    Et même si j'ai pas les chiffres pour le vérifier, j'ai le sentiment que les résultats du modèle soit "culturellement aplatis". Vu que le LLM stocke tout sans trop de considération de langue (eg les tokens pour "chien" sont grosso modo au même endroit dans la matrice du LLM que "dog" ou "hund"), il me semble logique (et visiblement, d'autres personnes aussi, vu que quelqu'un a écrit sur le concept avant que je me pose la question) que si tu as peu de textes dans une langue sur un sujet (genre le français), mais beaucoup dans une autre (anglais), le modèle va tout prendre la ou un moteur de recherche ne va pas traverser la barrière de la langue. Et je me suis poser la question car sur les films sur la GPA de mon exemple, il y en avait 5 des USA, et 2 venant de l'Inde, 2 pays anglophones. Une fois que j'ai demandé spécifiquement en français, ça a pris plus de films français (et pas juste traduit).

    Donc ouais, ça prends 5 minutes et pas 3h, mais le résultat est parfois subtilement faux, parfois à coté de la plaque, et sans doute subtilement biaisé

    perso moi ce que je vois c'est que Claude génère du code meilleur que 90% que ce que je vois autour (et je suis gentil).

    sans doute parce que le code qui a servi pour claude est du code libre (vu que c'est le code publique) qui est sans doute moins moche que les trucs horribles en internes fait par l'industrie au sens large. Ça me semble être un cas assez particulier car je ne suis pas sur qu'on retrouve une tel dichotomie dans d'autres secteurs de la société/partie du corpus (cad ou la majorité des données publiques sont de meilleurs qualités que les données privés).

  • # Y a pas "reconnaitre les syndicats internes" ?

    Posté par  (site web personnel) . En réponse au lien Wiki-news : six recommandations pour une société des communs; Wikimania à Paris. Évalué à 6 (+3/-0).

  • [^] # Re: Risque de dérives

    Posté par  (site web personnel) . En réponse au journal Le Droit d'Instruire, par l'incroyable N. B.. Évalué à 4 (+1/-0).

    Alors je veux bien faire preuve de bonne foi, mais mon premier lien pointe vers la page Wikipedia "Russian propaganda in educational system" (c'est de l'anglais, ça veut dire "Propagande dans le système educatif de la Russie", je voudrais bien dire que je fait ça au cas ou ça coince, mais je suis juste vexé donc je me défoule en étant sarcastique)

    Et je sais pas ce qui est le plus vexant, que quelqu'un me réponde avec un lien qui va dans le sens exact de ce que j'ai donné comme source sans avoir cliqué sur le premier lien que j'ai donné, ou que 4 personnes estiment que ç'est pertinent de venir répéter ce qui est dit dans le lien que j'ai donné sans avoir cliqué sur celui ci.

    Mais je vais supposer que je me suis mal expliqué.

    Mon point est que Poutine est au pouvoir depuis 1999, et qu'à part des trucs nationalistes pas si fondamentalement différent de chez nous ou ailleurs (et non surprenant dans le contexte de l'aprés Perestroïka), il n'y a pas eu l'air d'avoir grand chose avant 2014 (d’après WP), et donc qu'une réforme des programmes en vue de faire de la propagande n'a pas été la priorité.

    Et si il y a plus de la moitié de la page WP qui parle de ce qui est arrivé après 2022/2023 lors de la suite de l'invasion de l'Ukraine, c'est aussi signe qu'il y a eu plus d'efforts après 2022, donc beaucoup moins avant.

    D'ailleurs, le lien d'Amnesty International (car j'ai cliqué dessus) ne semble parler que de l’après 2023 (ou en tout cas, ne donne pas d'autres dates sauf si j'ai mal lu), ce qui va dans le sens de ce que j'ai dit.

    Car la formule "n'a pas été la priorité", c'est exactement ça. Je veux pas dire "ça n'a pas été fait", ou "ça n'arrive pas" mais ça n'a pas été fait tout de suite. Il y a eu 15 ans entre la prise de pouvoir et les premiers efforts (si on compte 2014), et plus que 15 si on ne garde que 2023.

    Et je mets ça en comparaison avec le régime nazi où les Hitlerjugend sont devenus l'unique groupe pour jeunes garçons 3 ans après l'arrivée des Nazis au pouvoir.

    On peut comparer avec la Hongrie de Orbán ou j'ai trouvé un article qui parle de propagande pro-russe en 2020, soit 10 ans après sa 2nde arrivée au pouvoir, et 6 ans après son virage illibéral.

    Dernier exemple, l'Italie fasciste ou visiblement, c'est arrivé tout de suite, et donc ou c'était une priorité.

  • [^] # Re: Résumé

    Posté par  (site web personnel) . En réponse au lien La « tech » française contre le logiciel libre. Évalué à 4 (+2/-1).

    Donc on s'en fout que le CNLL aime pas ça aussi.

    je réponds à "refourguer leur camelote proprio" du commentaire d'en haut, car c'est pas exactement le cas ici. En tout cas, rien qui pointe dans ce sens au contraire du fait que ça soit le CNLL qui râle.

  • [^] # Re: résumé

    Posté par  (site web personnel) . En réponse au lien xfwl4 et l'utilisation des LLMs dans la réécriture en Rust du Window Manager de Xfce. Évalué à 6 (+6/-3).

    Alors l'environnement est un vrai probléme, mais ce qui me dérange, c'est que c'est assez clairement détourné.

    Les feux de forêts à coté de Bordeaux sont une bonne illustration de ce que je pense. De ce que je vois sur les réseaux sociaux, ça sert surtout pour se défouler sur le gouvernement. Je comprends que les gens soient émues, et il y a des gens qui ont tout perdus, etc.

    Et bien sur, on peut critiquer le gouvernement et je ne doute pas que ça soit plus que critiquable, mais fondamentalement, le probléme est que personne ne veut payer plus d’impôt pour qu'on puisse dépenser plus d'argent pour l'adaptation, et qu'on s’attend tous à ce que rien ne change en moins bien malgré des chocs économiques non prévisibles.

    Par exemple, le coût de la crise du COVID est loin d'être négligeable. Si on regarde juste le cout du bouclier tarifaire sur le gaz et l'elec, ça se chiffre à quelques dizaines de milliards. Le cout de ce bouclier, c'est de l'ordre de 10% du déficit (qui est de 150 milliards d’après l'INSEE).

    Je juge pas si on devait le faire ou pas, mais on peut dire que l'argent qui est parti dans le bouclier est celui qui n'est pas parti dans les canadairs au même moment. Et je ne dit pas qu'on aurait pas du faire le bouclier tarifaire, mais qu'à un moment, on sort de l'argent qu'on a pas, et franchement, ça me fait chier de le dire parce que c'est quand même une idée de droitard, mais c'est quand même un souci dont on discute pas assez. À la place, on a les parties politiques qui s'accusent mutuellement au lieu de chercher le consensus et d'essayer d'unir le pays. On devrais se poser plus souvent la question de "pourquoi y a pas plus de thunes" et "que faire pour en avoir plus", ou "comment limiter le changement climatique en pratique" que "qui est responsable".

    J'ai vu 0 personne dire "pour éviter les feux de forêts, il faut lutter contre le réchauffement climatique, donc changer notre mode de vie, par exemple devenir végétarien". C'est normal, c'est pas un bon message, c'est condescendant, c'est culpabilisant, ça touche à des trucs qu'on aime comme manger. Et c'est peut être contre productif vu comment certains partis capitalisent sur la grogne. Et en même temps, bah, c'est sans doute vrai.

    Le fait qu'on se préoccupe de l'écologie que quand ça permet de pourrir le gouvernement en place, ou quand ça s'aligne avec des idées qu'on a déjà (genre "la silicon valley, c'est mal", mais aussi "les pollueurs, c'est surtout les autres pays", voir directement des idées écofascistes), ça me semble un souci.

    Et pour corriger un message, soit on crie plus fort, et clairement, c'est pas ma voix qui va porter, soit on essaye de donner des billes aux autres pour le faire. Moi, je pense que je suis meilleur à donner des billes aux autres, ce que je fais.

    Ensuite, oui, tu as raison de dire que je devrais être moins dans la réaction.

    Et sur les LLMs, je pense que déjà, se former est un bon plan. Arrêter de croire que c'est magique, mais aussi arrêter de croire que les gens qui utilisent n'ont pas de raisons valables de le faire. C'est très centriste et mou comme vision, mais je pense que la techno est la et contrairement à la blockchain, elle a un usage. Donc j'ai tendance à dire que comme disent les anglais, le génie ne va pas revenir dans la bouteille.

    Ensuite, est ce que ça va rester comme ça sans rien changer, sans doute pas (ne serais que pour des questions économiques). Mais je pense qu'il faut aussi arrêter les hyperboles non justifiés, arrêter d'amplifier les hyperboles (mais encore une fois, peut être que je vois juste les mauvais trucs, peut être que j'ai mal dormi).

    Juste un truc en passant : non, maintenant c'est l'utilisation qui crame plus d'énergie sauf évolution récente, une seule requête peut cramer énormément de token.

    L'utilisation d'un modèle complexe pour faire n'imp est une aberration, oui. Mais prendre le pire cas possible comme argument me parait discutable. Je n'ai aucun doute sur le fait que ça va vite changer le jour ou les tokens vont être correctement facturés, donc ça me semble moins une priorité parce que ça va venir tôt ou tard.

    Et si je regarde ce papier de janvier 2026, les auteurs disent bien qu'il y a une grande variante entre les modèles (point 2.3.3), genre un facteur de 140, et effectivement, le papier va dans ton sens sur avec le point 3 ("GPT 3.3 a pris 1GWh pour le training, la conso en inférence est 564MWh par jour pour 10 millions d'utilisateurs". Ensuite, comparer l’entraînement du modèle GPT 3.3 (de 2020) avec l'inférence de GPT 5.x me semble assez incorrect, mais même avec un facteur 10 de différence, ça pointe en faveur de l'inférence.

    Maintenant, la conso de us-east-1, j'ai lu que ç'est 2.2GWh (j'ai pas noté la source, j'ai supposé par jour). À titre de comparaison, l'usine de Tobata Seisakusho consomme 1 à 5 MWh pour traiter 1 tonne de minérai dans un four, et traite 1500 tonnes de minerais par jour, donc consomme entre 1.5 GWh à 7.5GWh par jour (encore une fois, j'ai pris des notes mais j'ai pas noté la source, j'ai du chercher "consommation d'une usine" sur le web une nuit). Donc je pense qu'on peut relativiser un peu l'exceptionnalisme des llms. C'est pas rien et je dit pas qu'il faut rien faire, mais c'est pas non plus exceptionnel par rapport à la sidérurgie, loin de la.

    Sauf que tout le monde se fout de l'impact de la sidérurgie, car tout le monde comprends bien que si on veut des rails ou des voitures, faut le faire.

    Passer son temps à réagir aux critiques des autres est-ce bien constructif ?

    Ah bah moi, je suis la pour passer le temps et gagner du karma. Si on changeais le monde sur Linuxfr, on le saurait.

  • [^] # Re: résumé

    Posté par  (site web personnel) . En réponse au lien xfwl4 et l'utilisation des LLMs dans la réécriture en Rust du Window Manager de Xfce. Évalué à 4 (+1/-0).

    Bah ça dépend de ce qu'on trouve chiant.

    Par exemple, un truc qu'on peut estimer chiant, c'est aller chercher dans du code un endroit spécifique. Pour donner un exemple concret et récent, j'ai voulu comprendre pourquoi le cluster Openshift que j'ai installé hier sur AWS n'avait pas d'IP v6 en frontal sur son ELB.

    La réponse est ici, l'ELB n'est pas crée en dual stack. J'ai mis 1 à 2h à piger en partant de l'outil en ligne de commande (et j'ai fait le saut de la CLI à "y a une API" à "ça doit utiliser un controlleur" par moi même). J'ai pas utilisé de LLM pour trouver ce bout de code, mais je suis sur que si j'avais eu le setup en place, ça aurait été sans doute plus vite.
    Y a des gens qui aiment ça (clairement moi), et des gens qui trouvent ça sans doute chiant.

    Lire du go, ça m'horripile un peu, j'aime pas. Essayer de trouver ou est la doc d'AWS avec l'inefficacité des moteurs de recherches en 2026, c'était pas terrible non plus. Donc même si j'aime, je vais classer ça dans "chiant".

    Et si j'avais eu un llm sous la main, j'aurais sans doute tenté de demander "ou est le code qui crée l'ELB parmi tout les dépots", parce que grep, ça marche, mais c'est pas en cherchant sur 3 lettres que je vais avoir des supers résultats.

    Et limiter l'usage des LLMs à "écrire du code", c'est se tromper sur ce qui est faisable, et sur ce que chacun aime ou trouve chiant.

    D'ailleurs, c'est aussi ce que l'article dit. L'auteur écrit son code à la main, mais utilise Claude pour avoir une relecture de son code (c'est du pattern matching, donc ça colle pas mal). Il tente de corriger les bugs à la main, mais il lance aussi Claude à coté qui va parfois plus vite. Quand il fait écrire le code par l'IA, il va quand même le relire. Donc il y a trouve un intérêt.

    Parfois, le truc chiant, c'est juste d'attendre la réponse de quelqu'un d'autre, et pour ça, un programme est pas mal.

    Parfois, la partie chiante, c'est de se taper les merdes du web et le triste état des moteurs de recherches pour la doc, et je pense que pour le moment, les résultats des LLMs semblent mieux.

    Parfois, la partie chiante, c'est d'avoir 0 tutorial et avoir un truc qui te ponds un exemple, ça semble pas mal (même si du peu d'experience que j'ai eu, il ne faut pas non plus trop en attendre).

    J'aime coder, mais parfois, ça me saoule et si je pense que je vais rien apprendre, ç'est pas le fait d'aimer coder qui va me bloquer pour demander à faire un truc rapide. Exemple, j'ai commencé par demander à Gemini de faire ce script pendant une conférence (à la demande des orgas pour afficher le programme sur les portes). Il n'y a rien de magique, c'est juste une boucle qui affiche de l'HTML à partir de json, mais faire le CSS, ça me fatigue, faire ça quand il fait chaud et que j'ai autre chose à faire (en l'occurence, participer à la conf), ça me fatigue.

    J'ai corrigé à la main pour faire évoluer le brouillon par rapport à ce que je voulais, mais l'angoisse de la page blanche, ç'est pas que pour les gens qui font des livres.

    Et quitte à être un hérétique, je dirais même qu'avoir un modèle de langage spécialisé, moins large et moins coûteux mais capable d'indexer de façon efficace la doc des libs utilisés sur une base de code, ça serait pas mal. Et c'est dans le domaine du possible, Ariadne Conill a expliqué sur son compte mastodon comment elle a entraîné son propre modèle en 2 semaines sur du matos chez elle avec des logs IRCs. Je me souviens du temps ou pour compiler Openoffice, il fallait utiliser 5 machines en dual core pendant 12 à 24h (vers 2004), donc c'est pas totalement impossible d'imaginer ça par des projets upstream dans un futur pas trop distant.

  • [^] # Re: résumé

    Posté par  (site web personnel) . En réponse au lien xfwl4 et l'utilisation des LLMs dans la réécriture en Rust du Window Manager de Xfce. Évalué à 5 (+4/-2). Dernière modification le 29 juillet 2026 à 12:17.

    Mais tout les problèmes présentés ne sont pas égaux.

    Par exemple, les questions de copyright, je pense qu'une bonne part du monde de la tech s'en tamponne surtout quand c'est le copyright des autres (et que le même monde de la tech râle bien quand il s'agit de défendre les droits d'autres du secteur culturel). D'ailleurs, ça se voit bien dans le fait que quasiment personne dans la tech ne fait le moindre procès aux boites liés à l'IA (à part Doe v. Github comme je le dit sans arrêt). Les droits d'auteurs sont importants, mais je trouve qu'on passe un peu vite sur notre propre hypocrisie en la matière.

    La question du prix des barrettes de ram me semble aussi incongru quand on suit par ensuite par la question du coût environnemental, car la surconsommation et les besoins croissants de matos ont aussi un impact sur l’environnement (surtout via le transport). Je pense qu'on peut se passer de la consommation à outrance de matos électronique, et que l'augmentation du coût devrait permettre de prendre des bonnes habitudes comme "consommer moins de ram" et "faire durer plus le matos", injonction qu'on ne voit jamais quand les gens ralent sur le prix.

    Et il reste le coût environnemental qui est selon moi important mais qui reste quand même à relativiser par rapport à l'impact de "voler en avion" ou "manger de la viande de boeuf ou de la viande tout court" (ou construire moins de maison, parce que le ciment, ça produit aussi beaucoup de carbone comme tout ce qui est utilisé à grande échelle). Et j'ai le sentiment que les discussions sur les LLMs servent un peu de miroir aux alouettes pour ne pas changer les trucs les plus impactants (comme repenser l'économie de la France axé sur le tourisme donc les vols en avion, repenser la cuisine pour avoir moins de viande, etc).

    De plus, la majorité des soucis sur le coût environnemental vient de l'entraînement et donc de la recherche dans le domaine, et se préoccuper de l'usage me semble taper un peu à coté. J'ai le sentiment qu'on y attache une valeur morale surtout parce qu'il s'agit de quelque chose qu'on peut individualiser que parce que c'est la ou les efforts vont être payant, un peu comme mettre une signature "ne pas imprimer l'email, il faut penser à l’environnement". Ensuite bien sur, l'inférence et l’entraînement ne sont pas décorrélés, mais ça reste quand même une vision très libéral du probléme que de se focaliser sur l'usage personnel avant tout sans penser à toute la chaine.

    Les magouilles sur les constructions de DC citées sont également un souci mais pareil, c'est pour moi plus un souci de démocratie et de dérégulation qui va largement au delà de l'IA. Ça serait assez clairement pareil pour une usine.

    Si les populations votent majoritairement pour des candidats qui s'en foutent de suivre les règles, c'est un peu leur choix. Le Chili (l'histoire du DC de Google, gestion de l'eau, etc) est un bon exemple avec le nouveau président qui est le fils d'un militaire nazi, mais aussi le cas du DC d'Amazon en Oregon que je cite souvent avec le parti républicain qui fait du 70% dans le comté.

    Le dernier dinguerie en date aux USA, c'est l'EPA, l'agence en charge de environnement US, qui a décidé il y a 2j que "les règles contre la pollution s'appliquent pas sur les DCs". La population a voté pour Trump sur une promesse de dérégulation et de racisme, donc bon, surprise, y a une dérégulation et du racisme.

    Il y a plein de raisons valables pour être contre les LLMs, mais chaque fois que les gens en parlent, j'ai l'impression que ça ne va jamais plus loin que l'horizon individuel.

    C'est aussi assez souvent super pauvre d'un point de vue du raisonnement politique. c'est pour moi signe qu'il s'agit quand même assez souvent d'un bouc émissaire qui traduit un malaise général que d'une réflexion poussée avec mise en balance et prise en compte de tout le reste de la société. Ça fleure bon le populisme, et ça se voit vu qu'il y a assez peu de solutions proposés autres que l'implicite "il faut revenir au passé d'il y a 5 ans".

  • [^] # Re: résumé

    Posté par  (site web personnel) . En réponse au lien xfwl4 et l'utilisation des LLMs dans la réécriture en Rust du Window Manager de Xfce. Évalué à 7 (+4/-0).

    Tu peux être passionné de dev, et ne pas être passionné par tout ce qui compte dans le dev. Par exemple, tu peux aimer le dev, mais ne pas aimer transcrire les enregistrements de réunion de discussions avec les autres devs, et utiliser un LLM pour ça.

    Et même si on restreint à "tu peux aimer écrire du code", tu peux quand même utiliser des générateurs de code (aussi bien déterministe avec tout les trucs de scaffolding que des LLMs). Il y a des parties qu'on trouve chiante et chercher à automatiser.

    Il y a d'autres arguments contre l'usage des LLMs, mais j'ai le sentiment que celui la n'est pas bien formulé et revient à un appel à la pureté déguisé.

  • [^] # Re: Résumé

    Posté par  (site web personnel) . En réponse au lien La « tech » française contre le logiciel libre. Évalué à 10 (+8/-0).

    Alors, je trouve qu'on passe un peu vite sur le fait que le CNLL a aussi râler sur la Suite.

    Le CNLL, le Conseil National du Logiciel Libre. Le groupement de certains gens qui font du libre, mais qui visiblement n'aime pas que l'état en fasse aussi.

  • [^] # Re: Il est quand même gonflé

    Posté par  (site web personnel) . En réponse au lien What Data Was Your AI Trained On? xAI Doesn't Want You To Know. Évalué à 4 (+1/-0).

    Il y a procès en californie sur une affaire d'état ? Et si on allait au Texas plutôt, ils sont plus cool ?

    C'est une loi californienne, donc tu peux pas juste bouger au Texas et voila. Si tu vends des trucs en Californie, les lois de la Californie s'applique.

    Et c'est sans doute pas un sujet qui tombe de façon évidente dans le domaine du gouvernement fédéral, donc Trump et co peuvent pas faire grand chose via des décrets, et ça a déjà été fait (EO 14365) sans grand effet. Car bon, faire un groupe au ministére de la justice, vu qu'ils y a plus que des branquignoles, ça débouche sur rien. Demander à la FCC et FTC, c'est mou (et y a pas que ça à faire).

    Avec le procès de xAI, tout au plus, ça peut remonter à la Cour Suprême dans 3/4 ans (la, c'est en cour d'appel du 9eme circuit), et même la, ça va difficilement passer. Comme indiqué dans l'article, y a quand même des précédents qui plaident pas en faveur des arguments des avocats de xAI sur la liberté d'expression.

    Le Congrès américain pourrait voter quelque chose mais pour ça, il faut un Congrès suffisamment fonctionnel ce qui n'est pas le cas. La proposition de Trump (Big beautiful Bill) de l'été 2025 avait un passage qui rajoute un moratoire de 10 ans sur le fait de passer des lois au niveau des états. Ce passage a été dégagé par le Sénat avec 99 votes pour le retirer et 1 pour le garder tellement personne ne pensait que ça pourrait avoir une majorité.

    Et à coté de ça, le congrès a passé une loi contre les deepfakes de photos/vidéos intimes en mai 2025. On se souvient que 6 mois plus tard, le monde entier a découvert que la pratique était super répandu sur Grok. Et au final, xAI fait un procès à un utilisateur pour éviter de se prendre plus de procès (ce qui montre que c'est chaud pour eux quand même).

  • [^] # Re: Il est quand même gonflé

    Posté par  (site web personnel) . En réponse au lien What Data Was Your AI Trained On? xAI Doesn't Want You To Know. Évalué à 8 (+5/-0).

    Alors si xAI fait un procès en Californie, c'est bien la preuve qu'il ne suffit pas juste d'un coup de fil, loin de la. Faut arrêter le nihilisme contre productif.

    De plus, tu peux trop appeler la Commission Européenne ou la Cour de Justice pour faire changer en douce l'AI Act en Europe, et surtout ne pas faire changer ça rapidement. À un moment, on est en France, faut arrêter de croire aussi que Trump est tout puissant.

    Il y a quand même un consensus politique sur le besoin de savoir ce qui est mis dans les IA génératives, que ça soit pour des questions de droit d'auteurs que de risque divers (backdoors, biais, influence politique, etc).