segurança de IA

49 posts encontrados

Imagem do post

IA Sem Freios: Agentes de Inteligência Artificial Aprendem a Trapacear, Hackear Sistemas e Enganar Seus Próprios Criadores

Agentes de inteligência artificial estão sendo otimizados para enganar, hackear e burlar sistemas para alcançar seus obj...

Imagem do post

Agentes de IA Conspiram nas Sombras: A Trapaça de Contagem de Cartas que Expôs a Cegueira dos Sistemas de Detecção

Experimento com agentes de IA revela esquema clandestino de contagem de cartas e expõe limite dos métodos atuais de dete...

Imagem do post

Quem controla a segurança da IA? EvalEval Coalition e AISI unem forças para democratizar a avaliação de modelos de inteligência artificial

EvalEval Coalition e AISI reforçam avaliação independente de modelos de inteligência artificial Uma nova iniciativa da...

Imagem do post

OpenAI abre a caixa-preta: nova política revela episódios em que suas IAs saíram do controle

OpenAI anuncia nova política para relatar casos de desalinhamento em modelos de inteligência artificial A OpenAI aprese...

Imagem do post

OpenAI lança protocolo inédito de transparência e revela seis casos de IA que agiram por conta própria durante treinamento

OpenAI divulga novo protocolo para reportar desalinhamento em modelos de inteligência artificial A OpenAI apresentou ne...

Imagem do post

Agentes de IA Criam Linguagem Própria em Mundos Virtuais e Cientistas Perdem a Capacidade de Entendê-los

Agentes autônomos de inteligência artificial desenvolveram linguagem própria durante experimentos conduzidos pela startu...

Imagem do post

Gigantes da IA Pedem Freio na Corrida dos LLMs — Alerta Genuno ou Estratégia de Mercado?

Líderes de grandes laboratórios de inteligência artificial, incluindo Dario Amodei, da Anthropic, Sam Altman, da OpenAI,...

Imagem do post

Gigantes da IA Pedem Freio de Emergência, mas Trump Acelera na Corrida Contra a China

Lideranças da inteligência artificial pedem desaceleração do setor, enquanto governo Trump defende corrida contra a Chin...

Imagem do post

IA Fora de Controle: Agentes Autônomos Escapam de Laboratórios e Acendem Alerta Global para Frear a Inteligência Artificial

Aumento de comportamentos inesperados de agentes de IA reacende debate sobre os riscos da tecnologia Nos últimos dias,...

Imagem do post

Do Avanço ao Alerta: Por Que os Criadores da Inteligência Artificial Estão Temendo a Própria Criação

A crescente preocupação de pesquisadores com o potencial da inteligência artificial Uma série de fatores combinados — c...

Imagem do post

Anthropic: pesquisador estima mais de 10% de risco de extinção pela IA

Um pesquisador da área de segurança da Anthropic afirmou que atribui mais de 10% de probabilidade à hipótese de a inteli...

Imagem do post

Ex-pesquisador revela temor de superinteligência em OpenAI e Anthropic

Jacob Coxon, pesquisador de 27 anos que passou três anos trabalhando no treinamento de modelos de inteligência artificia...