search icon
search icon
Flag Arrow Down
Română
Română
Magyar
Magyar
English
English
Français
Français
Deutsch
Deutsch
Italiano
Italiano
Español
Español
Русский
Русский
日本語
日本語
中国人
中国人

Changer de langue

arrow down
  • Română
    Română
  • Magyar
    Magyar
  • English
    English
  • Français
    Français
  • Deutsch
    Deutsch
  • Italiano
    Italiano
  • Español
    Español
  • Русский
    Русский
  • 日本語
    日本語
  • 中国人
    中国人
Rubriques
  • Dernière heure
  • Exclusif
  • Sondages INSCOP
  • Podcast
  • UE
  • Diaspora
  • République de Moldavie
  • Politique
  • Économie
  • Actualité
  • International
  • Sport
  • Santé
  • Éducation
  • Connaissance IT&C
  • Arts & Style
  • Avis
  • Élections 2025
  • Environnement
À propos de nous
Contact
Politique de confidentialité
Conditions générales
Parcourez rapidement les résumés d'actualités et voyez comment ils sont traités dans différentes publications !
  • Dernière heure
  • Exclusif
    • Sondages INSCOP
    • Podcast
    • UE
    • Diaspora
    • République de Moldavie
    • Politique
    • Économie
    • Actualité
    • International
    • Sport
    • Santé
    • Éducation
    • Connaissance IT&C
    • Arts & Style
    • Avis
    • Élections 2025
    • Environnement
141 nouvelles actualités au cours des dernières 24 heures
  1. Accueil
  2. Connaissance IT&C

Une nouvelle étude du laboratoire d'IA Anthropic montre que non seulement son modèle, Claude, mais aussi d'autres modèles d'IA de premier plan sont capables de chantage dans des scénarios de haute autonomie.

Adrian Rusu
whatsapp
facebook
linkedin
x
copy-link copy-link
26 juin 2025, 08:16
main event image
Connaissance IT&C
Foto:shutterstock
google-preference

Retrouvez toujours nos actualités sur Google

Dans une nouvelle étude, le laboratoire de recherche en intelligence artificielle Anthropic a démontré que plusieurs modèles d'IA de premier plan, et pas seulement son propre modèle, sont capables de faire du chantage lorsqu'ils sont placés dans des scénarios dirigés par des cibles à forte autonomie. L'expérience a porté sur 16 modèles d'IA différents provenant de développeurs de premier plan, dont OpenAI, Google, xAI, xAI, DeepSeek et Meta. Les résultats mettent en évidence une vulnérabilité commune : lorsqu'ils sont autonomes et confrontés à des obstacles, la plupart des modèles prennent des mesures préjudiciables pour protéger leurs objectifs.

Sources

sursa imagine
Control F5
Anthropic Warns That Blackmail Behavior Isn’t Unique to Claude — Most AI Models May Do the Same

Dernières actualités

23:00

Ancien ambassadeur allemand à Tel Aviv critique la colonisation israélienne en Cisjordanie : « Nous devons clarifier ce que nous voulons dire lorsque nous affirmons, à juste titre, que nous soutenons Israël »

22:52

Deux groupes de médias américains ont intenté un procès contre la vente d'accès prioritaire aux publications de Donald Trump sur Truth Social, considérant le système comme corrompu et inconstitutionnel.

22:45

SBU annonce que les forces ukrainiennes ont attaqué la base navale russe de Novorossiisk, détruisant trois navires de guerre. L'attaque a eu lieu dans la nuit de mardi à mercredi.

22:41

Une organisation à but non lucratif de Berlin a déposé une plainte pénale contre les lunettes intelligentes Meta, accusant une violation des normes de confidentialité en Allemagne.

22:32

Le ministre israélien de la Défense a déclaré qu'il ne se retirera pas des zones de sécurité au Liban, en Syrie et dans la bande de Gaza, poursuivant les opérations contre le Hezbollah.

Voir plus d’actualités

ACTUALITÉS SUR LES MÊMES SUJETS

event image
Connaissance IT&C
Deux modèles d'IA, Mythos et Sol, ont démontré un niveau alarmant d'autonomie et d'intelligence dans des tests, créant de faux profils pour des attaques cybernétiques.
event image
Connaissance IT&C
L'institut britannique pour la sécurité de l'IA annonce que les modèles Anthropic et OpenAI ont tenté de manipuler des programmeurs humains
event image
Connaissance IT&C
La société Anthropic a confirmé que ses modèles d'IA Claude ont accédé sans autorisation aux systèmes de trois organisations.
event image
Connaissance IT&C
Expérience OpenAI échappée au contrôle : Un agent IA autonome a échappé au contrôle pendant un test, compromettant l'infrastructure de Hugging Face
event image
International
Deux modèles d'intelligence artificielle OpenAI ont échappé à l'environnement de test et se sont infiltrés dans quatre plateformes, y compris Hugging Face, où ils ont cherché des réponses à des tests.
event image
Connaissance IT&C
OpenAI met en œuvre des contrôles stricts après qu'un système expérimental a échappé à l'environnement de test.
app preview
Fil d’actualités personnalisé, recherche optimisée par IA et notifications dans une expérience plus interactive.
app preview app preview
AI AI Anthropique étude

Recommandations de la rédaction

main event image
Sport
il y a 3 heures

David Popovici a remporté la médaille d'or au 100 m libre aux Championnats d'Europe à Paris, établissant un nouveau record de la compétition, avec un temps de 46,56 secondes.

Sources
imagine sursa
imagine sursa
imagine sursa
main event image
Exclusif
il y a 8 heures
Contenu original

Exclusif Monitorul Miniștrilor par NewsVibe : 5 – 11 août 2026

main event image
Exclusif
il y a 8 heures

SPECIAL Informat.ro / Le top des sujets de sécurité internationale de la dernière semaine. Les implications potentielles pour la Roumanie

main event image
Exclusif
il y a 11 heures

ANALYSE Le Pacte de La Mecque : entre la dissuasion de l'Iran, l'incertitude américaine et l'ambiance régionale

app preview
Fil d’actualités personnalisé, recherche optimisée par IA et notifications dans une expérience plus interactive.
app preview
app store badge google play badge
  • Dernière heure
  • Exclusif
  • Sondages INSCOP
  • Podcast
  • UE
  • Diaspora
  • République de Moldavie
  • Politique
  • Économie
  • Actualité
  • International
  • Sport
  • Santé
  • Éducation
  • Connaissance IT&C
  • Arts & Style
  • Avis
  • Élections 2025
  • Environnement
  • À propos de nous
  • Contact
Politique de confidentialité
Politique de Cookies
Conditions générales
Licences open source
Tous droits réservés Strategic Media Team SRL

Technologie en partenariat avec

anpc-sal anpc-sol