Patrones de configuración de producción de OpenClaw con plugins y habilidades
Cómo están realmente estructurados los sistemas OpenClaw
OpenClaw parece simple en las demostraciones. En producción, se convierte en un sistema.
Cómo están realmente estructurados los sistemas OpenClaw
OpenClaw parece simple en las demostraciones. En producción, se convierte en un sistema.
Una sola base de datos o una pila de búsqueda real
El verdadero debate no es si PostgreSQL puede buscar texto o si Elasticsearch puede almacenar documentos. Ambos pueden hacerlo. La pregunta interesante es dónde debe residir la complejidad de la búsqueda.
La alerta es un sistema de respuesta, no un sistema de ruido
El enmascaramiento de alertas se describe con demasiada frecuencia como una característica de monitoreo. Ese encuadre es conveniente, pero oculta el verdadero problema.
Plataformas de chat como planos de control para sistemas
Las plataformas de chat han evolucionado mucho más allá de las herramientas de mensajería. En los sistemas modernos, funcionan como interfaces entre los procesos automatizados y la toma de decisiones humana.
Slack es una interfaz de usuario de flujo de trabajo y una capa de entrega de alertas.
Las integraciones de Slack parecen engañosamente fáciles porque puedes publicar un mensaje en una sola llamada HTTP. La parte interesante comienza cuando quieres que Slack sea interactivo y fiable.
Convierte Discord en un bus de alertas seguro e interactivo.
Discord se convierte en una superficie de integración seria cuando lo tratas como tal: un lugar donde los sistemas publican eventos, los humanos toman decisiones y la automatización continúa el flujo de trabajo.
Patrones para integraciones, estructura de código y acceso a datos.
La mayoría de los consejos sobre arquitectura de aplicaciones son demasiado abstractos para aplicarlos o demasiado limitados para escalarlos. Aquí presentamos compensaciones prácticas para sistemas en producción en términos de integración, estructura del código y acceso a datos.
Las suscripciones a Claude ya no impulsan agentes
La puerta trasera silenciosa que impulsó una ola de experimentación con agentes ahora está cerrada.
Búsqueda de IA autoalojada con LLM locales
Vane es una de las entradas más pragmáticas en el espacio de “búsqueda de IA con citas”: un motor de respuestas autoalojado que combina la recuperación web en vivo con LLM locales o en la nube, manteniendo toda la pila bajo tu control.
Programación con agentes, ahora con backends de modelos locales.
Claude Code no es autocompletado con mejor marketing. Es una herramienta de codificación agéntica: lee tu base de código, edita archivos, ejecuta comandos y se integra con tus herramientas de desarrollo.
Instalación y guía rápida del agente Hermes para desarrolladores
Hermes Agent es un asistente de IA autoalojado y agnóstico en cuanto a modelos, que se ejecuta en una máquina local o en un VPS de bajo costo, funciona a través de interfaces de terminal y mensajería, y mejora con el tiempo convirtiendo tareas repetidas en habilidades reutilizables.
Instala TGI, despliega rápido, depura más rápido.
Text Generation Inference (TGI) tiene una energía muy específica. No es el último en llegar en la calle de la inferencia, pero es el que ya aprendió cómo se rompen las cosas en producción -
Velocidad de tokens de llama.cpp con 16 GB de VRAM (tablas).
Aquí estoy comparando la velocidad de varios LLM que se ejecutan en GPU con 16 GB de VRAM, y eligiendo el mejor para autoalojamiento.
La RTX 5090 en Australia es escasa y sobrevalorada.
Australia tiene existencias de la RTX 5090. Escasamente. Y si encuentras una, pagarás un sobreprecio que parece desconectado de la realidad.
Acceso remoto a Ollama sin puertos públicos
Ollama funciona mejor cuando se trata como un demonio local: la CLI y sus aplicaciones se comunican con una API HTTP de bucle local, y el resto de la red nunca descubre su existencia.
Registros JSON consultables que se conectan a trazas.
Los registros son una interfaz de depuración que aún puedes usar cuando el sistema está en llamas. El problema es que los registros en texto plano envejecen mal: en cuanto necesitas filtrado, agregación y alertas, comienzas a analizar oraciones.
Recibe nuevas publicaciones sobre sistemas, infraestructura e ingeniería de IA.