AgentesAplicaciones 🇷🇺 29.07.2026 11:04

Añadí un LLM al chat de mis amigos y lo hice interpretar a un Terminator (y abrí un portal a un multiverso de locura)

NVIDIANVIDIA Google/DeepMindGoogle/DeepMind OpenRouterOpenRouter
Un desarrollador integró un LLM gratuito a través de OpenRouter en un chat grupal de Telegram con 15 amigos, indicando al bot que interpretara al Terminator (T-800). El bot puede responder mensajes, bromear con los participantes según el contexto, leer imágenes, audio y video, clasificar prompts peligrosos y tiene una memoria basada en RAG. El proyecto se trasladó posteriormente a un portátil local usando Gemma-4-12b y llama.cpp para un mejor rendimiento.
Un desarrollador decidió añadir un bot impulsado por LLM a un chat de grupo de Telegram con 15 amigos, indicándole que interpretara el papel del Terminator (T-800). El bot utiliza modelos gratuitos de OpenRouter (inicialmente Nemotron-3-Super-120b para texto, luego nemotron-nano-12b-v2-vl para visión, con respaldo a nemotron-3-nano-omni-30b-a3b-reasoning). Más tarde, el bot se trasladó a un portátil local con Gemma-4-12b ejecutándose en llama.cpp para manejar tanto texto como multimedia en un solo flujo. El bot puede responder a mensajes, burlarse de los participantes, leer imágenes, audio y vídeo, resumir libros y cómics, realizar búsquedas web, clasificar indicaciones peligrosas mediante un enfoque de dos pasadas (primero un modelo clasificador, luego el modelo principal) y mantener memoria a largo y corto plazo mediante RAG. El clasificador de dos pasadas en mensajes largos (más de 200 caracteres) utiliza nemotron-3-nano-30b para rechazar indicaciones absurdas o sobrecargadas antes de que lleguen al modelo principal. El autor señala que el proyecto no está listo para producción, pero sirve como un divertido proyecto personal.
Fuente: Habr — хаб NLP — original
Nuestros artículos anteriores sobre este tema ↓
Noticias frescas