The Daily Commit · Edición de sección Portada PHP AI Dev EN DE FR ES

TheModelDesk

8 de julio de 2026
modelos, agentes e inferencia local

Noticias

Los LLM locales necesitan RAG para respuestas técnicas precisas

Un desarrollador evaluó modelos locales (Gemma, Qwen, Apple Intelligence) en 7.648 preguntas técnicas de documentación popular. Los modelos aislados funcionaron mal; agregar RAG con recuperación de documentos mejoró significativamente la precisión. El razonamiento extendido aportó ganancias mínimas con alto costo computacional.

Un desarrollador evaluó la precisión de LLM locales, incluyendo Qwen, Gemma QAT y el modelo AFM 2 3b de Apple, mediante 7.648 preguntas de opción múltiple. Dichas preguntas fueron generadas por deepseek-v4-flash basándose en la documentación markdown de Node, TypeScript, Vue, Langchain.js y transformers.js.

Los resultados indicaron que los modelos independientes tuvieron un desempeño deficiente. Sin embargo, la precisión mejoró drásticamente al integrar un sistema RAG (Generación Aumentada por Recuperación). Apple Intelligence (AFM 2 3b) logró un sólido 86%, a pesar de tener una ventana de contexto limitada a 4k tokens, frente a los 32k de los demás modelos.

El uso de modos de razonamiento ("thinking") solo aportó una mejora marginal del 1%, pero con un costo computacional significativamente mayor. Estos hallazgos se aplican a «Chatwise», una aplicación de aprendizaje disponible en la App Store para iPhone y macOS.

Leer la fuente original (en inglés) ↗

Valora este artículo: 0

Tribuna de lectores

Aún no hay aportaciones — abre el debate.

← The Model Desk — Page C1

Models, agents & local inference · The Daily Commit · Edición de pantalla · Información legal · Política de privacidad