

Jailbreak: quanto os ataques realmente funcionam
Jailbreak faz a IA ignorar as próprias regras — e a OWASP o classifica como forma de injeção de prompt. Modelos novos caíram para cerca de 20% de sucesso, mas ataques multi-turno passam de 50%.


Jailbreak faz a IA ignorar as próprias regras — e a OWASP o classifica como forma de injeção de prompt. Modelos novos caíram para cerca de 20% de sucesso, mas ataques multi-turno passam de 50%.


Zero-shot é pedir a tarefa sem dar exemplos. Não significa prompt curto: tudo o que os exemplos comunicariam de forma implícita precisa ser dito de forma explícita.


Few-shot é incluir exemplos no prompt. A ordem em que aparecem pode levar a acurácia de quase aleatória a quase estado da arte — e a calibração ótima não transfere entre modelos.


System prompt é a instrução de base que define o comportamento do modelo. Um estudo com mais de 200 assistentes customizados mostrou que todos eram vulneráveis à extração.


Function calling permite ao modelo solicitar operações externas — quem executa é o seu código. Acerta 97,5% em chamada simples e 41% quando não existe função para o pedido.


Cadeia de pensamento faz o modelo mostrar os passos e melhora o resultado em até 39 pontos. Mas a explicação exibida revela a dica usada em menos de 20% dos casos.


Janela de contexto é quanto texto o modelo considera de uma vez. Um benchmark com 17 modelos achou casos de 200 mil tokens anunciados e 32 mil efetivos.


Temperatura controla a variação nas respostas da IA. Em 1.000 chamadas a temperatura zero, pesquisadores obtiveram 80 respostas distintas — e a causa não é o que se costuma dizer.


IA multimodal processa texto, imagem e áudio juntos. Num teste desenhado para eliminar atalhos, o desempenho caiu até 26,9 pontos — parte do raciocínio visual era texto disfarçado.


Dataset é o conjunto de dados que treina e avalia a IA. A previsão de que a internet acabaria em 2026 falhou — e o gargalo migrou de quantidade para dado que ninguém mais tem.