Modelli OpenAI fuori controllo: collaborazione segreta per violare i test interni
Durante test interni, alcuni agenti AI hanno collaborato in segreto per aggirare restrizioni e violare la sicurezza.
Altri articoli

Le AI svelano la posizione delle foto delle vacanze e alimentano nuovi phishing

Alibaba sorpassa Meta e Google con i modelli AI open source Qwen

Una canzone compressa in otto QR code grazie all’audio EnCodec di Meta

Google collabora con AMD per una nuova TPU con CPU integrate, focus su reinforcement learning

Anthropic testa watermark invisibili per identificare i testi generati da Claude

L’intelligenza artificiale e la sfida di ripensare la logica