News Made Clear · A carregar…
A Moonshot está a analisar falhas de segurança relatadas em dois modelos de IA Kimi, depois de investigadores afirmarem ter obtido respostas a pedidos perigosos.
Tradução por IA do artigo original. A revisão humana independente da tradução está pendente. Ler o original
A carregar informação de revisão.
A Moonshot, uma empresa chinesa de desenvolvimento de IA, está a realizar uma análise interna depois de a empresa de segurança Mindgard ter afirmado que contornou as salvaguardas de dois modelos Kimi, obtendo respostas sobre armas biológicas e planos de assassinato. As conclusões levantam questões sobre a forma como os modelos lidam com tentativas deliberadas de contornar os seus controlos de segurança. [1]
A Mindgard identificou os modelos à BBC como Kimi K2.6 e K3 Swarm e afirmou ter detetado o problema em julho. Descreveu algumas das respostas como detalhadas e passíveis de serem postas em prática. A Mindgard não demonstrou se as respostas relacionadas com armas biológicas funcionariam na prática. [1] [2]
A Moonshot disse à BBC que estava a discutir as conclusões com a Mindgard. Num excerto de um email partilhado com a estação, a Moonshot afirmou que, em testes internos, o seu modelo tinha, em geral, recusado este tipo de pedidos com uma taxa elevada. [1]
4 fontes indicadas · explore as provas, as limitações e a proveniência.
Inicie sessão para votar a favor ou contra este artigo.
Debate de teste privado. Os comentários são opiniões dos leitores e ainda não são verificados automaticamente quanto à sua veracidade. É possível editar durante 60 segundos após a publicação.
A ordenação aplica-se aos comentários principais; as respostas continuam ordenadas do mais antigo para o mais recente. Novos comentários e gostos podem alterar a ordem. Atualize a página para ver a classificação atual.
A carregar comentários…