Actualización llama.cpp b9196: los binarios precompilados para Windows soportan CUDA 13.1, Vulkan, HIP y SYCL
Panorama de herramientas AI PPT populares: cómo elegir entre generación automática, presentaciones web, PPTX e imágenes
¿Puede Sulphur 2 ejecutarse con 8 GB de VRAM? Notas de despliegue local de un modelo de video LTX 2.3
Claude Code duplica sus límites: Anthropic usa la expansión de cómputo con SpaceX para aliviar restricciones
Los nuevos modelos de voz Realtime de OpenAI: GPT-Realtime-2, traducción en vivo y transcripción en streaming
Cómo dividir tareas entre ChatGPT, Claude y Gemini: elección de uso diario, codificación y capacidades especiales
Por qué las API de LLM cobran por tokens: una guía clara sobre los costos de entrada, salida y contexto