UNSPLASH/ALEXANDER SHATOV
MADRID 7 out. (Portaltic/EP) -
A Musubi Labs apresentou um modelo de decisão de código aberto e de tamanho reduzido, projetado para a moderação de conteúdo em tempo real com base nas políticas das plataformas, com capacidade de adaptar-se às mudanças imediatamente.
O PolicyLM-1.7B foi desenvolvido para auxiliar as equipes de Confiança e Segurança que precisam agir rapidamente diante de uma mensagem problemática, seja em chats, mensagens diretas, salas de jogos e até mesmo nomes de usuário, especialmente em plataformas que gerenciam mais de um milhão de mensagens por dia.
O que esse modelo faz é analisar as políticas da plataforma em cada mensagem, sem gerar texto, e oferecer um julgamento binário (0 ou 1) sobre se a infração se enquadra em cada uma das categorias (pré-definidas ou personalizadas) de dano, conforme explicado em um comunicado.
Com isso, ele oferece uma ferramenta aos moderadores humanos para que possam agir rapidamente antes que a conversa avance, com capacidade, além disso, de incorporar imediatamente as alterações recentes feitas nas políticas.
O modelo é baseado na arquitetura BidirLM-1.7B-Embedding (derivada do Qwen3-1.7B) e, por ser de tamanho reduzido (1,7 bilhão de parâmetros), é ideal para analisar e classificar conteúdo em grande escala. Ele pode ser executado em laptops ou em uma GPU de 24 GB e oferece uma resposta em 35 milissegundos, em média, por mensagem curta em uma GPU L4.
Os pesos do PolicyLM-1.7B foram publicados no Hugging Face e no Baseten.
Esta notícia foi traduzida por um tradutor automático