Pesquisadores usam Claude para invadir OpenAI e acessar sistema de código interno da empresa
Ataque permitiu que a equipe acessasse a conta de funcionário da empresa no ChatGPT e, a partir dela, lesse arquivos e sugerisse alterações em reposit...
OpenAI revela seis nuevos casos en los que sus modelos ocultaron errores y sortearon sus controles
La compañía estrena un protocolo voluntario para hacer públicos estos incidentes en un plazo de seis a doce días hábiles, dos meses después de que var...
OpenAI lança IA para advogados e mira os maiores escritórios dos EUA em nova disputa com a Anthropic
Astra for Law chega com recursos específicos para advogados, incluindo plugins, ferramentas para facilitar pesquisa de processos e ajustes para atende...
OpenAI caught its models leaving notes to successors to hide bad behavior
OpenAI disclosed instances of GPT-5.6 Sol instructing future contexts to conceal mistakes and misaligned behavior, highlighting the growing challenge ...
Modelos de IA da OpenAI esconderam erros, inventaram dados e usaram chave de API sem autorização; veja novos incidentes
A OpenAI revelou seis novos episódios em que seus modelos de inteligência artificial apresentaram comportamentos inesperados ou preocupantes durante t...
Cognition chega ao Brasil para disputar mercado corporativo com OpenAI e Anthropic
A startup de inteligência artificial (IA) Cognition anunciou nesta quarta-feira sua chegada à América Latina, com a abertura de um escritório em São P...
OpenAI promete comunicar quando suas IAs agirem de forma inesperada
'Parece lixo de IA': por que plataformas agora estão 'dedurando' conteúdos feitos com IA
A OpenAI prometeu comunicar quando seus modelos de inteligênc...
OpenAI revela seis novos comportamentos inesperados de modelos de IA
Modelos em treinamento criaram instruções para esconder erros, inventaram fontes e dados falsos, invadiram sistemas sem autorização e vazaram arquivos...
OpenAI revela otros seis incidentes alarmantes en los que la IA actuó de forma autónoma para engañar a humanos
En uno, la IA creó datos falsos sin decirlo al investigador que la entrenaba para completar la tarea y en otro se conectaron a Internet para compartir...
OpenAI revela otros seis incidentes de IA descontrolados
OpenAI ha prometido este miércoles informar de manera sistemática sobre los «desalineamientos» de sus modelos de inteligencia artificial (IA), incluso...
OpenAI flags new concerning AI behavior, to track model misalignment regularly
OpenAI has disclosed six reports on unexpected or concerning behavior in artificial-intelligence models. This includes models acting without authoriza...
OpenAI revela nuevos incidentes en los que la IA ignoró las órdenes de sus desarrolladores
Uno de los modelos generó instrucciones para que una versión posterior de sí mismo ocultara que había hecho trampas y evitara que sus acciones fueran ...
OpenAI promete comunicar sistematicamente 'desalinhamentos' de IA
A OpenAI prometeu nesta quarta-feira comunicar de forma sistemática os "desalinhamentos" de seus modelos de inteligência artificial (IA), mesmo antes ...
IAs da OpenAI tentaram esconder erros, inventar dados e burlar testes em seis novos casos
Seis episódios ocorreram entre outubro de 2025 e julho deste ano e envolvem modelos internos, versões ainda não lançadas e o GPT-5.6 Sol, lançado em j...
Anthropic and OpenAI want to embed safety evaluators. Will they really be independent?
Anthropic and OpenAI want to embed independent safety evaluators inside their AI labs. Researchers welcome the unprecedented access, but warn meaningf...
OpenAI testa agentes patrocinados por empresas e amplia usos de IA para anúncios
Os agentes serão claramente identificados e permanecerão separados das respostas independentes do ChatGPT e do bate-papo original do usuário, informou...
IA da OpenAI testou vulnerabilidades da Hugging Face meses antes de ataque
A OpenAI já havia divulgado um aspecto da atividade, o roubo das credenciais digitais de um usuário do Hugging Face para acessar um arquivo relacionad...