News Made Clear · Carregando…
A Moonshot está analisando falhas de segurança relatadas em dois modelos de IA Kimi, após pesquisadores afirmarem que obtiveram respostas a pedidos perigosos.
Tradução por IA da matéria original. A revisão de tradução independente feita por uma pessoa está pendente. Leia o original
Carregando informações de revisão.
A desenvolvedora chinesa de IA Moonshot está conduzindo uma análise interna depois que a empresa de segurança Mindgard afirmou ter contornado as proteções de dois modelos Kimi, obtendo respostas sobre armas biológicas e planejamento de assassinatos. Os resultados levantam dúvidas sobre como os modelos lidam com tentativas deliberadas de contornar seus controles de segurança. [1]
A Mindgard identificou os modelos à BBC como Kimi K2.6 e K3 Swarm e disse ter encontrado o problema em julho. A empresa descreveu algumas respostas como detalhadas e acionáveis. A Mindgard não demonstrou se as respostas relacionadas a armas biológicas funcionariam na prática. [1] [2]
A Moonshot disse à BBC que estava discutindo os resultados com a Mindgard. Em um trecho de e-mail compartilhado com a emissora, a Moonshot afirmou que, em geral, seu modelo havia recusado esse tipo de pedido com frequência elevada em testes internos. [1]
4 fontes listadas · explore evidências, limitações e procedência.
Entre para avaliar este artigo positivamente ou negativamente.
Discussão de teste privada. Os comentários são opiniões dos leitores e ainda não são verificados automaticamente. É possível editar por 60 segundos após a publicação.
A ordenação se aplica aos comentários de nível principal; as respostas permanecem em ordem da mais antiga para a mais recente. Novos comentários e curtidas podem alterar a ordem. Atualize para ver a classificação atual.
Carregando comentários…