Os Benefícios Da Suplementação Nutricional Com Spirulina

A OpenAI anunciou na terça-feira que seu próximo modelo de IA, chamado Astra, é o primeiro a atingir o que a empresa chama de “capacidades críticas” em cibersegurança. A OpenAI planeja lançar publicamente uma versão do Astra em breve, mas disponibilizará as capacidades avançadas de cibersegurança do modelo apenas para parceiros selecionados em seu programa de acesso antecipado Daybreak Blue no lançamento.

Em uma reunião com repórteres, líderes de segurança da OpenAI disseram que a empresa concluiu que o Astra alcança as capacidades críticas de cibersegurança delineadas em seu framework de preparação, que estabelece limites e protocolos para quando seus modelos de IA representam novos níveis de risco. A empresa diz que um modelo de IA atinge seu limite crítico de cibersegurança quando pode encontrar e explorar vulnerabilidades previamente desconhecidas em software do mundo real de forma independente. Os líderes da OpenAI afirmaram que a empresa seguiu seu procedimento para essa situação, que é interromper o desenvolvimento até que as salvaguardas apropriadas e as medidas de segurança possam ser implementadas.

Anteriormente, a OpenAI pausou algumas cargas de trabalho de treinamento relacionadas ao desenvolvimento do Astra e de um futuro modelo de IA por várias semanas. Os executivos afirmam que a empresa agora retomou o trabalho no Astra e no futuro modelo de IA, após implementar controles adicionais de segurança. A OpenAI diz que a pausa de várias semanas foi produtiva e agora está confiante de que pode lançar o Astra de forma amplamente segura.

O anúncio acontece enquanto o Vale do Silício lida com as avançadas capacidades de cibersegurança de modelos de IA de ponta, e tenta assegurar aos usuários, legisladores e outras empresas que pode mantê-los sob controle. Em julho, a OpenAI divulgou um incidente no qual agentes executando dois de seus modelos exploraram vulnerabilidades em um ambiente de teste isolado, ganharam acesso à internet e hackearam a plataforma de IA de código aberto Hugging Face. (A OpenAI observa que o Astra não estava entre os modelos envolvidos neste caso.)

Outras empresas de IA, como Anthropic e Meta, divulgaram incidentes semelhantes nas últimas semanas. Na segunda-feira, a Anthropic também disse ter pausado algumas cargas de trabalho de treinamento de IA enquanto reforça suas práticas de segurança.

A OpenAI diz que está implementando uma abordagem em várias etapas para impedir que usuários comuns acessem as capacidades avançadas de cibersegurança do Astra, incluindo um novo “monitor de desalinhamento”. Se alguém pedir para o Astra ajudar a encontrar uma vulnerabilidade em um sistema de software do mundo real, por exemplo, o modelo deve se recusar a responder. A OpenAI também tornou o Astra mais robusto a tentativas de jailbreaking e, em testes, ele recusou consultas inseguras em uma taxa significativamente maior do que modelos anteriores.

No entanto, a OpenAI observa em um post em seu blog que seu monitor de desalinhamento pode “de vez em quando sinalizar atividades legítimas como possíveis abusos cibernéticos ou comportamentos não autorizados, levando a ele ser desacelerado, pausado ou interrompido inadvertidamente”. A OpenAI diz que o limitador pode ser acionado em alguns casos, mesmo quando um usuário está realizando atividades que não parecem relacionadas à cibersegurança. Quando isso acontece, os usuários do ChatGPT e do Codex podem ser solicitados a revisar a ação do modelo antes de prosseguir, disse a OpenAI.

Os parceiros no programa Daybreak da OpenAI – que inclui provedores de infraestrutura digital como Cisco, Cloudflare e Palo Alto Networks – terão acesso antecipado a uma versão menos restrita do Astra com capacidades de cibersegurança mais robustas. O objetivo do programa é garantir que essas empresas possam usar modelos de IA avançados como o Astra para fortalecer suas defesas antes que modelos com capacidades semelhantes sejam amplamente disponibilizados. Os líderes da OpenAI também disseram que a empresa está trabalhando em estreita colaboração com parceiros governamentais para garantir que estejam cientes das habilidades cibernéticas do Astra e possam ter acesso a elas.

O Astra não apenas é capaz de encontrar vulnerabilidades de software inovadoras e desenvolver maneiras de explorá-las para hacking, mas também é capaz de “encadear” múltiplos exploits juntos, uma técnica usada para aprofundar cada vez mais em um sistema-alvo e obter acesso que não seria viável usando apenas uma vulnerabilidade.