Avatar 🍥

KnightLi Blog

记录并分享日常

  1. Inicio
  2. Acerca de
  3. Archivo
  4. Buscar
  5. Enlaces
    1. Modo oscuro

Archivo

2026 240
2025 18
2024 5
2023 8
2022 18
2020 1

Categorías

Herramientas de IA Documentacion tecnica Hardware Herramientas de desarrollo Operaciones Industria de IA Actualizaciones de seguridad

Etiquetas

Codex AI Agent Ai-Tools Developer Tools Claude Code AI Coding Local LLM Linux Ollama MCP Claude Windows NAS OpenAI GPU Docker Open Source Python Ubuntu Llama.cpp Anthropic CVE Cybersecurity Agent Skills AI Video Browser Automation ChatGPT CUDA Hugging Face Operations
Herramientas de IA

¿Cómo conectar Codex con modelos chinos? APIs compatibles con OpenAI y el enfoque de CodexBridge

CodexBridge encapsula Codex CLI/SDK como una API de chat compatible con OpenAI, de modo que OpenWebUI, Cherry Studio, curl y otros clientes puedan llamar a Codex local mediante /v1/chat/completions. Este artículo resume sus usos, despliegue, sesiones, entrada multimodal, salida estructurada y configuración común.

2026-05-13
Tiempo de lectura 6 minutos
Herramientas de IA

¿Puede Sulphur 2 ejecutarse con 8 GB de VRAM? Notas de despliegue local de un modelo de video LTX 2.3

Sulphur 2 es un modelo de generación de video publicado por SulphurAI y basado en LTX 2.3. Soporta text-to-video, image-to-video y varios flujos de trabajo de LTX 2.3. Este artículo resume entradas de ejecución local, viabilidad con 8 GB de VRAM, elección de herramientas y fallos comunes.

2026-05-12
Tiempo de lectura 12 minutos
Herramientas de IA

Ejecutar DeepSeek 4 en local: el experimento ds4 de Antirez en Apple Silicon Mac

ds4 es un motor de inferencia local para DeepSeek V4 Flash escrito por Antirez para Apple Silicon, con CLI, HTTP server y capacidades básicas de agent.

2026-05-11
Tiempo de lectura 4 minutos
Herramientas de IA

Cómo medir el rendimiento multi-GPU en llama.cpp: ¿2x V100 16GB son más rápidas que una sola GPU de 32GB?

Una guía práctica sobre el rendimiento multi-GPU offload en llama.cpp: dos GPU no siempre son más rápidas cuando una sola tarjeta puede cargar el modelo, pero ayudan mucho cuando una GPU de 16GB tendría que recurrir a CPU offload. También cubre las diferencias entre V100 PCIe y NVLink.

2026-05-09
Tiempo de lectura 9 minutos
Herramientas de IA

Qué hacer si suspenden tu cuenta de Claude: límites de Claude Code y guía de apelación

Distingue los límites normales de Claude y Claude Code, los problemas de suscripción o autorización y la suspensión de cuenta, y sigue los pasos oficiales de diagnóstico y apelación de Anthropic.

2026-05-09
Tiempo de lectura 6 minutos
Documentacion tecnica

Dirty Frag CVE-2026-43284: riesgo de escalada local en Linux y guía de mitigación

Guía práctica sobre Dirty Frag CVE-2026-43284: rutas de ataque en Linux, riesgo asociado a CVE-2026-43500 / rxrpc, mitigaciones temporales, prioridad de parches y comprobaciones post-compromiso.

2026-05-09
Tiempo de lectura 6 minutos
Herramientas de IA

Cómo detectar texto generado por Claude 4: herramientas y métodos de detección de AI

Guía práctica de herramientas, señales algorítmicas y flujos de revisión para detectar texto generado por Claude 4 y otros LLM modernos, recordando que la detección de AI solo ofrece evidencia probabilística.

2026-05-08
Tiempo de lectura 12 minutos
Herramientas de IA

Codex vs Claude Code: cómo elegir entre dos diseños de Subagent

Comparación entre los mecanismos de Subagent de Codex y Claude Code: Codex prioriza delegación explícita y control de la sesión principal; Claude Code se parece más a un sistema de puestos Agent configurables, con memoria, aislamiento y ejecución en segundo plano.

2026-05-08
Tiempo de lectura 11 minutos
Herramientas de IA

DeepSeek-TUI: ejecuta un agente de programación DeepSeek en la terminal

Resumen práctico de DeepSeek-TUI: un agente de programación en terminal para modelos DeepSeek con edición de archivos, comandos shell, modos Plan/Agent/YOLO, selección automática de modelo, MCP, reanudación de sesiones y rollback de workspace.

2026-05-08
Tiempo de lectura 4 minutos
Herramientas de IA

Qué modelos locales de IA puede ejecutar un portátil RTX 4060 8GB

Guía práctica para cargas locales de IA en un portátil RTX 4060 8GB: LLM pequeños, modelos de código, Stable Diffusion, FLUX GGUF, Whisper, indexación de imágenes y consejos de VRAM y temperatura.

2026-05-08
Tiempo de lectura 5 minutos
Herramientas de IA

Tutorial de 9Router: conectar Claude Code, Codex y Cursor a un único router de IA

9Router es un router local para AI coding. Esta guía cubre instalación, integración con Claude Code/Codex/Cursor, endpoint OpenAI-compatible, compresión de tokens, fallback de modelos y rutas multi-cuenta.

2026-05-08
Tiempo de lectura 6 minutos
Hardware

AMD ROCm 7.2 + ComfyUI: configuracion de compatibilidad para usar una alternativa a CUDA en Windows

Guia practica para ejecutar ComfyUI, AI art local y herramientas de video AI en hardware AMD con ROCm 7.2 en Windows y Linux, incluyendo Radeon, Ryzen AI y las diferencias frente a CUDA.

2026-05-08
Tiempo de lectura 9 minutos
Hardware

Benchmarks de inferencia AI en RTX 5090 / 5080: como elegir para LLM locales, video 4K y 3D en tiempo real

Una lectura practica de las especificaciones y pruebas AI de RTX 5090 y RTX 5080, centrada en VRAM, ancho de banda, FP4, software, LLM locales, video 4K, generacion de imagen y 3D en tiempo real.

2026-05-08
Tiempo de lectura 8 minutos
Documentacion tecnica

Mejores LLM locales para RTX 3060 12 GB: cuantización, contexto y pruebas

Cómo elegir y medir modelos GGUF de 7B, 8B y 12B en una RTX 3060 de 12 GB con Ollama, llama.cpp, nvidia-smi, presupuestos reales de VRAM y recuperación de fallos.

2026-05-08
Tiempo de lectura 20 minutos
Herramientas de desarrollo

opencode, Claude Code y Codex: diferencias y guía de herramientas open source de programación con IA

¿Qué diferencias hay entre opencode, Claude Code y Codex? Este artículo compara tres herramientas de programación con IA por apertura, soporte de modelos, experiencia en terminal, modos Agent y casos de uso.

2026-05-08
Tiempo de lectura 11 minutos
Documentacion tecnica

Como elegir una distribucion Linux de escritorio en 2026: comparativa entre Ubuntu, Deepin/UOS, Linux Mint y Fedora

Una comparativa centrada en el escritorio entre Ubuntu 26.04 LTS, Deepin/UOS, Linux Mint y Fedora en 2026, cubriendo facilidad de uso, estabilidad, ecosistema de software, soporte de nuevas tecnologias y usuarios adecuados.

2026-05-07
Tiempo de lectura 10 minutos
Herramientas de IA

Tutorial de CC Switch: gestión segura de Claude Code, Codex, MCP y reversiones

Basado en el repositorio oficial de CC Switch, explica las fuentes de descarga fiables, el cambio de proveedor, los directorios de configuración, las copias automáticas, la conversión del protocolo de Codex, el diagnóstico y la reversión.

2026-05-06
Tiempo de lectura 15 minutos
Herramientas de IA

Guía inicial de Codex App: instalación, sandbox, tareas paralelas, Skills y MCP

Guía completa para empezar con Codex App: instalación, proyectos y tareas, permisos de sandbox, contexto, selección de modelos, Git, worktree, ejecución en la nube, AGENTS.md, plugins, Skills, MCP y automatización del ordenador.

2026-05-06
Tiempo de lectura 11 minutos
Industria de IA

ChatGPT marca un riesgo de ciberseguridad: motivos oficiales, Trusted Access y cómo informar errores

A partir de la información oficial de OpenAI, explica las comprobaciones adicionales de ciberseguridad en ChatGPT, Codex y la API, cómo gestionar tareas defensivas legítimas y qué aportar al solicitar Trusted Access o informar un falso positivo.

2026-05-06
Tiempo de lectura 6 minutos
Hardware

Si suben los discos y tu NAS esta lleno, no amplíes aun: TerraMaster usado + HC620 para datos frios

Cuando los discos duros estan caros, en vez de ampliar de inmediato el NAS principal, conviene descargar datos frios y copias a un HC620 y usar modelos TerraMaster F2-220, F2-221 o F4 como nodo economico de almacenamiento frio.

2026-05-04
Tiempo de lectura 10 minutos
Hardware

Instalar fnOS en TerraMaster F2-220: backplane F3, NVMe e inyeccion de modulo BIOS

Registro del proceso de instalar fnOS en TerraMaster F2-220: fabricar el backplane F3, conectar NVMe, instalar fnOS y usar flashrom para respaldar y flashear un BIOS con modulo NVMe inyectado.

2026-05-04
Tiempo de lectura 5 minutos
Hardware

Notas de pinout del backplane del NAS TerraMaster F2-221

Notas sobre el pinout no estandar del conector de backplane del TerraMaster F2-221 NAS, incluyendo SATA, alimentacion, PERST#, PCIe1 y parte de PCIe2.

2026-05-04
Tiempo de lectura 5 minutos
Hardware

Una mirada detallada a los modos de bifurcación PCIe

La bifurcación PCIe decide cómo se divide un grupo de lanes PCIe en x16, x8, x4 y otros anchos de enlace. Las implementaciones comunes incluyen Hard Strap, Soft Strap y Wait For BIOS.

2026-05-02
Tiempo de lectura 8 minutos
Herramientas de IA

faster-whisper: un motor de transcripción Whisper más rápido

faster-whisper reimplementa la inferencia de Whisper con CTranslate2, haciendo que la transcripción local y del lado del servidor sea más rápida y eficiente en memoria.

2026-05-01
Tiempo de lectura 16 minutos
Herramientas de IA

Cómo usar DeepSeek V4 Pro en Cline

Usa el proveedor OpenAI Compatible para conectar DeepSeek V4 Pro en Cline, incluyendo API Key, Base URL, nombre del modelo, longitud de contexto y solución de problemas comunes.

2026-05-01
Tiempo de lectura 6 minutos
Documentacion tecnica

Copy Fail CVE-2026-31431: riesgo de escape de contenedor en la ruta de copia de archivos del kernel Linux

Resumen de Copy Fail / CVE-2026-31431: alcance de impacto, causa raíz, riesgo de escape de contenedor, mitigaciones y recomendaciones de parcheo.

2026-05-01
Tiempo de lectura 6 minutos
Herramientas de IA

VRAM para Qwen3.6 local: medir cuantizaciones 27B y 35B-A3B

Separa pesos teóricos, tamaño GGUF y VRAM medida de Qwen3.6-27B y 35B-A3B, con pruebas reproducibles de cuantización, contexto, GPU y backend.

2026-05-01
Tiempo de lectura 12 minutos
Herramientas de IA

DeepSeek V4 local: memoria de Pro y Flash, hardware y elección de API

Guía basada en datos oficiales que separa parámetros totales y activos, tamaño teórico de pesos, memoria real, viabilidad multi-GPU y uso de la API para DeepSeek V4 Pro y Flash.

2026-05-01
Tiempo de lectura 12 minutos
Herramientas de IA

VRAM para Gemma 4 local: cómo elegir E2B, E4B, 12B, 26B o 31B

Guía práctica que separa la memoria aproximada de Google, el tamaño GGUF y la VRAM medida para elegir y probar Gemma 4 E2B, E4B, 12B, 26B y 31B.

2026-05-01
Tiempo de lectura 7 minutos
Hardware

Guía de módulos de cámara Sony IMX: especificaciones, referencias y precios de IMX335, IMX678, IMX415, IMX219, IMX273, IMX766 e IMX307

Guía práctica de módulos de cámara Sony IMX habituales: parámetros, enlaces públicos, fechas aproximadas y rangos de precio minorista para IMX335, IMX678, IMX415, IMX219, IMX273, IMX766, IMX307 y otros modelos comunes en Taobao.

2026-05-01
Tiempo de lectura 10 minutos
Herramientas de IA

Guía de mattpocock/skills: habilidades de AI coding para Claude Code y Codex

Guía del repositorio mattpocock/skills de Matt Pocock: qué es, qué skills de AI coding incluye, dónde ayuda con Claude Code/Codex/Cursor y cómo mejora aclaración, TDD, diagnóstico y revisión de arquitectura.

2026-05-01
Tiempo de lectura 11 minutos
Herramientas de IA

Dónde se guardan los Codex Skills: usuario, repositorio y fallos de carga

Scopes actuales de .agents/skills y diagnóstico de front matter, UTF-8 BOM, nombres duplicados y recarga de sesión.

2026-04-29
Tiempo de lectura 3 minutos
Hardware

¿Por qué son tan económicas las combinaciones de placa de 16 núcleos y CPU? ¿Realmente vale la pena comprar una placa integrada Xeon D-1581?

Una mirada directa a los combos de placa integrada + CPU Xeon D-1581: por qué parecen tan baratos, para qué sirven realmente y los pros y los contras que la gente suele pasar por alto.

2026-04-29
Tiempo de lectura 5 minutos
Hardware

¿Vale la pena comprar el Core Ultra 5 230F? Cómo se compara con el 12400F, 13490F y 7500F

Una mirada práctica a si vale la pena comprar el Core Ultra 5 230F en este momento comparándolo con alternativas comunes como el 12400F, 13490F y 7500F, incluidas sus fortalezas, debilidades y los tipos de construcciones que mejor se adaptan.

2026-04-28
Tiempo de lectura 7 minutos
Hardware

Cómo elegir un chipset Intel serie 800: diferencias de funciones entre Z890, W880, Q870, B860 y H810

Un desglose de la segmentación del chipset Intel serie 800, centrándose en las diferencias entre Z890, W880, Q870, B860 y H810 en recursos de expansión, permisos de overclocking, compatibilidad con ECC, vPro, USB4 y PCIe 5.0.

2026-04-27
Tiempo de lectura 8 minutos
Operaciones

Actualizaciones de hardware y GPU Ubuntu 26.04 LTS: CUDA, ROCm, DPC++ y más cambios de plataforma

Un resumen de las notas de la versión de Ubuntu 26.04 LTS relacionadas con la computación GPU, pilas de software de IA, soporte de hardware y requisitos de plataforma, incluidos DPC++, CUDA, ROCm, GPU Intel, Raspberry Pi, RISC-V e IBM Z.

2026-04-26
Tiempo de lectura 10 minutos
Operaciones

Lanzamiento de Ubuntu 26.04 LTS: importantes actualizaciones de escritorio con GNOME 50 y Linux 7.0

Un resumen rápido de las actualizaciones clave en las notas de la versión oficial de Ubuntu 26.04 LTS, incluidos GNOME 50, kernel de Linux 7.0, Wayland, actualizaciones de aplicaciones de escritorio, requisitos de hardware y rutas de actualización.

2026-04-26
Tiempo de lectura 6 minutos
Herramientas de IA

Ollama usa la CPU en vez de la GPU: diagnóstico y recuperación por plataforma

Siguiendo la documentación oficial de Ollama, usa ollama ps, los registros del servicio, nvidia-smi, las comprobaciones de GPU en Docker y los permisos de dispositivos AMD para localizar la causa de la ejecución en CPU y verificar la solución.

2026-04-24
Tiempo de lectura 9 minutos
Herramientas de IA

Qu茅 es NVIDIA nvbandwidth: c贸mo usar esta herramienta de prueba de ancho de banda de GPU

Basado en el repositorio oficial NVIDIA/nvbandwidth y su p谩gina de releases, este art铆culo explica qu茅 hace la herramienta de prueba de ancho de banda de GPU, de qu茅 depende, c贸mo usarla, c贸mo funciona la prueba multinodo y qu茅 cambi贸 en v0.9.

2026-04-24
Tiempo de lectura 7 minutos
Hardware

C贸mo la gu铆a de dise帽o ATX 3.0 de Intel clasifica los conectores de alimentaci贸n auxiliar PCIe para GPU

Basado en la gu铆a Intel ATX 3.0 Multi Rail Desktop Platform Power Supply Design Guide, este art铆culo ordena el papel, rango de potencia y se帽ales sideband de los conectores auxiliares PCIe de GPU m谩s comunes: 2x3, 2x4 y 12V-2x6.

2026-04-23
Tiempo de lectura 8 minutos
Herramientas de IA

Cómo Elegir Modelos de Embedding Comunes: OpenAI vs BGE vs E5 vs GTE vs Jina

Una comparación práctica de modelos de embedding comunes como OpenAI, BGE, E5, GTE y Jina, centrándose en cómo elegir para casos de uso en chino.

2026-04-23
Tiempo de lectura 6 minutos
Hardware

¿Sigue valiendo la pena comprar una Tesla V100? ECC, mods de refrigeración y trampas DIY

Guía práctica para comprar una Tesla V100: cómo leer fechas de producción y pistas visuales, interpretar ECC, detectar manipulación y entender por qué la refrigeración y alimentación DIY fallan tan fácilmente.

2026-04-23
Tiempo de lectura 8 minutos
Herramientas de IA

Cómo comparar el rendimiento GPU de llama.cpp: CUDA, ROCm, Vulkan y pruebas reproducibles

Explica las métricas pp, tg, cuantización y Flash Attention de llama-bench, ofrece pruebas reproducibles para CUDA, ROCm y Vulkan, y evita mezclar resultados incompatibles en una sola clasificación de GPU.

2026-04-23
Tiempo de lectura 14 minutos
Herramientas de desarrollo

Cómo elegir un entorno de desarrollo embebido en 2026: Keil, STM32CubeIDE, VS Code y colaboración AI

En 2026, cuando la programación asistida por AI ya es común, ¿cómo deberían elegir entorno los desarrolladores embebidos? En lugar de apostar por un único IDE, una respuesta práctica suele ser dejar que Keil maneje build/debug y VS Code edición/colaboración AI.

2026-04-22
Tiempo de lectura 7 minutos
Herramientas de IA

Guía práctica de formatos tensoriales comunes en LLMs: FP32, FP16, BF16, TF32 y FP8

Introducción práctica a los formatos tensoriales más comunes en modelos grandes: FP32, FP16, BF16, TF32 y FP8, con sus layouts de bits, tradeoffs y por qué moldean entrenamiento y despliegue.

2026-04-22
Tiempo de lectura 7 minutos
Herramientas de IA

Una GPU de 16GB aún puede ejecutar modelos 35B: estrategias de compresión VRAM para modelos MoE en LM Studio

Una mirada práctica a cómo una GPU de 16GB todavía puede ejecutar modelos MoE de clase 35B: con la arquitectura correcta y ajustes de LM Studio, 16GB de VRAM no necesariamente te limitan a modelos 12B-14B.

2026-04-22
Tiempo de lectura 6 minutos
Hardware

12V-2x6 frente a 12VHPWR: notas sobre las diferencias en el conector de alimentación de 16 pines de la GPU

Una nota concisa sobre las principales diferencias entre los conectores de alimentación de 16 pines de GPU 12V-2x6 y 12VHPWR: compatibilidad de cable, longitud de pin, lógica SENSE, marcado H++ y capacidad de salida de 600W.

2026-04-19
Tiempo de lectura 5 minutos
Herramientas de IA

Uso más eficiente de la cuota de código de Claude: modelos, contexto, almacenamiento en caché y /compact

Una nota práctica sobre por qué el uso de Claude Code y Claude Pro/Max puede agotarse rápidamente: elección de modelo, ventanas de uso de 5 horas, largas conversaciones, archivos e imágenes, errores de caché, CLAUDE.md, MCP y habilidades, con hábitos en torno a /compact, /clear, /context y /status.

2026-04-19
Tiempo de lectura 10 minutos
Herramientas de IA

Notas del proyecto rembg: una herramienta de eliminación de fondo local

Una mirada práctica a danielgatis/rembg: qué es, cómo instalarlo, uso de CLI, integración de Python, modo de servidor HTTP, uso de Docker, opciones de modelo y dónde encaja en los flujos de trabajo de eliminación de fondo locales.

2026-04-19
Tiempo de lectura 7 minutos
Herramientas de IA

Notas de Ollama Multi-GPU: agrupación de VRAM, selección de GPU y malentendidos comunes

Un resumen práctico del comportamiento de múltiples GPU de Ollama: cuando los modelos se dividen en GPU, cómo limitar los dispositivos con CUDA_VISIBLE_DEVICES / ROCR_VISIBLE_DEVICES, si se puede agrupar VRAM, si funcionan las GPU mixtas y los problemas comunes de Docker, PCIe y de rendimiento.

2026-04-19
Tiempo de lectura 11 minutos
1 2 3 4 5 6
© 2022 - 2026 KnightLi Blog
记录并分享
Política de privacidad
Creado con Hugo
Tema Stack diseñado por Jimmy