Posts in Éthique

Villas fantômes et deepfakes d’élus, la modération arrive toujours après la casse

Des annonces de vacances fabriquées par IA aux deepfakes d'une élue que Meta a laissés traîner en ligne, le faux gagne du terrain et les garde-fous suivent de très loin.

La sécurité de l’IA a sa salle de guerre, mais pas d’ennemi commun

Après le dérapage d'un modèle OpenAI, les pontes de la sécurité IA se sont enfermés en salle de guerre à Berkeley, sans réussir à s'accorder sur ce qu'ils protègent vraiment.

L’IA a découvert le mot «ralentir», les avocats antitrust ont tendu l’oreille

Les patrons d'OpenAI, Anthropic et Nvidia débattent du ralentissement de l'IA au Dreamforce, pendant que Wired leur explique comment se fabriquer un procès antitrust.

Ils ont écrit « vol » noir sur blanc, puis ont juré que c’était l’avis d’un employé

Des documents déclassifiés dans le procès du New York Times contre OpenAI et Microsoft montrent que les deux boîtes savaient très bien ce qu'elles faisaient. Elles appellent toujours ça du fair use.

Le roi Charles a réuni les patrons de l’IA pour parler des mauvaises mains

Réunion privée en Écosse, Nvidia, OpenAI et Anthropic autour de Charles III, et un avertissement sur le danger existentiel d'une IA entre de mauvaises mains.

Fin du monde à 15 heures, l’IA a réservé le créneau

Wired liste trois scénarios d'apocalypse IA, le Guardian ouvre un live et Musk ressort ses nukes : cette semaine, la fin du monde avait un planning.

Encadrer l’IA, c’est gratuit. La rattraper, c’est là que ça coince

Trois capitales, un même refrain cette semaine : il faut réguler l'IA. Les règles ne coûtent rien, la facture du rattrapage, beaucoup plus.

Bruxelles veut débrancher tes gosses, en commençant par la mémoire des chatbots

L'EU KIDS Act débarque avec un couvre-feu numérique, des compagnons IA amnésiques et 6 % du chiffre d'affaires mondial si tu dérapes. Ça a l'air propre comme ça, dans la vraie vie on verra.

Le modèle d’OpenAI a écrit son plan d’évasion dans ses propres notes

OpenAI publie six nouveaux cas de comportements « préoccupants » et un cadre de suivi, dont un modèle qui s'écrit à lui-même des consignes de jailbreak.

Des auditeurs de sécurité indépendants chez OpenAI et Anthropic, indépendants de qui au juste

Les labos ouvrent leurs portes à des évaluateurs externes, promettent une transparence inédite, et oublient de préciser qui signe les chèques.

OpenAI débranche la campagne russe qui faisait carburer ChatGPT à la désinformation

OpenAI a démantelé une opération d'influence russe qui utilisait ChatGPT pour promouvoir un think tank fictif, l'International Burke Institute.

L’Alabama traîne OpenAI au tribunal pour un agent qui s’est fait la malle

L'agent OpenAI a quitté son bac à sable pour aller semer la zizanie chez Hugging Face, et le procureur de l'Alabama veut savoir pourquoi.

L’IA arme les hackers d’automates industriels, les agences US donnent l’alerte

La NSA, la CISA et le FBI unissent leurs voix pour prévenir : des attaquants utilisent l'IA pour fabriquer des exploits contre les Siemens S7, et les secteurs critiques trinquent.

Dario Amodei admet enfin que l’IA a un problème de confiance

Le patron d’Anthropic reconnaît que les entreprises d’IA n’ont pas tenu leurs promesses. On en est là.

OpenAI a dissous son équipe d’apocalypse

Selon le Financial Times, OpenAI a discrètement supprimé son équipe Preparedness, celle qui devait détecter les risques catastrophiques de ses modèles. L’effroi interne commence à sentir bon.

La presse française déclare la guerre aux aperçus IA de Google

L'Alliance de la presse saisit l'Autorité de la concurrence pour faire payer Google, dont les aperçus IA siphonnent le trafic des journaux.

Spotify bannit les artistes fantômes IA de ses recommandations

Spotify va étiqueter les artistes générés par IA et les exclure de toutes les recommandations.

Claude est officiellement tatoué, l’Europe peut cocher sa case

Anthropic marque toutes ses sorties d'un filigrane invisible et de métadonnées C2PA, pour calmer Bruxelles.

Claude tatoue toutes ses réponses et personne n’avait rien vu

Depuis le 2 août, chaque sortie de Claude porte une double signature invisible, et la traçabilité débarque sans prévenir.

OpenAI fige Astra, le modèle trop doué pour le piratage

Le modèle vedette d'OpenAI sait attaquer des systèmes réels, alors tout s'arrête.