OPEN IA v2.0 — Inteligencia Artificial Grado Militar

Sistema de orquestación inteligente de 30+ modelos de IA.
Selecciona automáticamente el mejor modelo para cada tarea. Routing inteligente + cadena de fallback + auto-aprendizaje + grafo de conocimiento.

  ╔═══════════════════════════════════════════════════╗
  ║     OPEN IA v2.0 — PRODUCCIÓN GRADO MILITAR      ║
  ║     Routing: inteligente · Fallback: automático    ║
  ║     Modelos: 30+ · Memoría: 4-capas               ║
  ║     ESTO ES PRODUCCIÓN, NO UN PROYECTO             ║
  ╚═══════════════════════════════════════════════════╝

Cómo Usar el Orquestador Open IA

El sistema está diseñado para que no tengas que pensar qué modelo usar — Open IA lo hace por ti.

Modo Más Simple (Recomendado)

Solo escribe tu tarea directamente. El orquestador (por defecto) analiza qué necesitas y rutea al mejor modelo automáticamente.

Ejemplo: "Hazme una función en Python que ordene una lista"
→ Analiza: tarea de coding → Claude Sonnet 4.5 (mejor coding calidad/precio)

Routing Manual (Cuando Quieres Control)

Si quieres... Usa este comando
Cualquier tarea (que el orquestador decida) /openia o escribe directo
Coding de alto rendimiento /code
Refactorizar código grande /refactor
Prototipar rápido /prototype
Analizar codebase grande /longcontext
Web full-stack /web
UI/UX bonita /ui
Razonamiento paso a paso /think
Pregunta rápida /quick
Sin internet /offline
Se agotaron tokens /fallback
Aprender algo nuevo /context o /aprender
Tarea muy compleja /fusion o /swarm
App desde cero /autoapp

Ejemplos Prácticos

Tú: "Créame una API REST en Node.js con Express y MongoDB"
Open IA: → Detecta coding completo → Claude Opus 4.5 (SWE-bench 80.9%)

Tú: "Hazme el diseño de un dashboard"
Open IA: → Detecta UI/UX → Claude Sonnet 4.5

Tú: "Necesito una app web rápida, un MVP"
Open IA: → Detecta prototipado → Gemini 3 Pro (2M contexto, rápido)

Tú: "Refactoriza este archivo de 500 líneas"
Open IA: → Detecta refactor grande → GPT-5.1 Codex-Max

Tú: "Explícame qué significa este error en 2 palabras"
Open IA: → Detecta consulta simple → Groq Llama 3.1 8B (ultra-rápido)

Routing Inteligente — Mapa Completo

TAREDA                           → MODELO ÓPTIMO                 → COSTO
──────────────────────────────────────────────────────────────────────────
CUALQUIER TAREA (default)        → Nemotron 3 Ultra 550B         → GRATIS
Coding complejo multi-archivo    → Claude Opus 4.5               → PREMIUM
Coding diario / code review      → Claude Sonnet 4.5             → PREMIUM
Refactor masivo (horas)          → GPT-5.1 Codex-Max             → PREMIUM
Prototipado rápido (MVPs)        → Gemini 3 Pro (2M)             → PREMIUM
Análisis de codebase grande      → Gemini 3 Pro (2M)             → PREMIUM
Web full-stack                   → Groq Llama 4 Scout            → GRATIS rápido
UI/UX profesional                 → Claude Sonnet 4.5             → PREMIUM
Razonamiento estructurado        → Sequential Thinking + Claude  → PREMIUM
Chat rápido / consulta simple    → Groq Llama 3.1 8B             → GRATIS rápido
Seguridad web (scan)             → Gemini 3 Flash                → PREMIUM
Imágenes/video IA                → Higgsfield MCP                → Créditos
Sin internet                     → Codestral 2501 (local)        → GRATIS offline

Todos los Modelos Disponibles (30+)

Cloud — Gratis

Modelo Proveedor Contexto Ideal para
Nemotron 3 Ultra 550B OpenRouter 1M Default. Coding agéntico, razonamiento, tool calling
Llama Nemotron Super 49B OpenRouter 131K Tareas balanceadas
Nemotron 3 Nano 30B OpenRouter 131K Tareas ligeras rápidas
Nemotron 3 Nano Omni OpenRouter 256K Contexto extendido
Big Pickle OpenCode Zen 200K Orquestación general
DeepSeek V4 Flash OpenCode Zen 200K Código rápido
MiMo-V2.5 OpenCode Zen General
North Mini Code OpenCode Zen Código pequeño

Cloud — Groq (Gratis, Ultra-rápido)

Modelo Contexto Velocidad Ideal para
Llama 4 Scout 17B 131K 🚀🚀🚀 Web full-stack
Llama 3.3 70B 131K 🚀🚀 Coding, razonamiento
Qwen 3 32B 131K 🚀🚀 Código, razonamiento
Qwen 3.6 27B 131K 🚀🚀 Web, código
GPT OSS 120B 131K 🚀 Alta capacidad open-source
GPT OSS 20B 131K 🚀🚀 Gama media
Llama 3.1 8B 131K 🚀🚀🚀🚀 Chat rápido, consultas
Groq Compound 131K 🚀🚀🚀 Respuestas compuestas

Cloud — Premium (Requieren API Key)

Modelo Benchmark Contexto Costo ($/M tok) Ideal para
Claude Opus 4.5 SWE-bench 80.9% 🥇 200K $5/$25 Coding complejo, producción
Claude Sonnet 4.5 SWE-bench 77.2% 200K $3/$15 Coding diario, UI, review
Claude Haiku 4 200K Tareas rápidas
GPT-5.1 Codex-Max SWE-bench 77.9% 200K ~$1.25/$10 Refactor largo, multi-archivo
GPT-5 200K Propósito general
GPT-4o 128K Tareas legacy
o3 200K Razonamiento STEM
Gemini 3 Pro SWE-bench 76.2% 2M 🏆 ~$2/$12 Prototipado, contexto largo
Gemini 3 Flash 1M ~$0.30/$1.20 Análisis rápido
Nemotron 3 Ultra 550B 1M Enterprise (DeepInfra)
Nemotron 3 Super 120B 1M Enterprise (DeepInfra)

Locales — Ollama (13 modelos instalados)

Modelo Params Contexto Uso
Codestral 2501 🥇 22B 256K Código local, FIM 95.3%
DeepSeek Coder V2 16B MoE 128K Código local multi-lenguaje
Qwen 2.5 Coder 32B 32B 128K Código local alta calidad
CodeGeeX4 9B 32K Código chino/inglés
Yi-Coder 9B 128K Code completion
Phi-4 (Microsoft) 14B 128K Tareas locales eficientes
Gemma 4 (Google) 9B 16K Tareas generales
Mistral 7B 7B 32K Chat local rápido
Gemma 3 4B 8K Ultra-ligero
DeepSeek Coder 6.7B 6.7B 16K Código ligero

Cadena de Fallback Automática

Cuando un modelo agota tokens o falla, el sistema cambia automáticamente:

NIVEL 1  → Nemotron 3 Ultra 550B FREE   (1M contexto, GRATIS)
NIVEL 2  → Claude Opus 4.5              (SWE-bench 80.9%, PREMIUM)
NIVEL 3  → Claude Sonnet 4.5            (SWE-bench 77.2%, PREMIUM)
NIVEL 4  → GPT-5.1 Codex-Max            (refactor largo, PREMIUM)
NIVEL 5  → Gemini 3 Pro                 (2M contexto, PREMIUM)
NIVEL 6  → Gemini 3 Flash               (1M rápido, PREMIUM)
NIVEL 7  → Groq Llama 4 Scout           (GRATIS rápido)
NIVEL 8  → Groq Llama 3.3 70B           (GRATIS rápido)
NIVEL 9  → Codestral 2501 local         (GRATIS offline)
NIVEL 10 → Qwen 2.5 Coder 32B local     (GRATIS offline)
NIVEL 11 → DeepSeek Coder V2 local      (GRATIS offline)
NIVEL 12 → Phi-4 / Gemma 4 local        (GRATIS offline ultra-ligero)

MCP Servers (12 configurados)

Servidor Tipo Función
open-knowledge-graph local Grafo de conocimiento propio
codebase-memory-mcp local Grafo de código 158 lenguajes
sequential-thinking local Razonamiento estructurado
context7 remote Documentación actualizada
n8n local Automatización workflows
agent-browser local Automatización navegador
graphify local Grafo AST global
higgsfield remote Supercomputador IA imagen/video
github local API de GitHub
filesystem local Acceso a archivos
playwright local Testing E2E
memory local Memoria persistente

Arquitectura

┌─────────────────────────────────────────────────────┐
│              OPEN IA v2.0 ORCHESTRATOR                │
│           Modelo: Nemotron 3 Ultra 550B FREE          │
├─────────────────────────────────────────────────────┤
│                                                       │
│  QUERY ENGINE    │  TOOL SYSTEM    │  TOKEN OPTIMIZER │
│  ┌────────────┐  │  ┌──────────┐  │  90-99% reduce   │
│  │ WAL        │  │  │ R/W Lock │  │                  │
│  │ Recovery   │  │  │ Classifier│  │  Prompt Cache    │
│  │ Compaction │  │  │5 Permissions│ │  Delta Mode     │
│  └────────────┘  │  └──────────┘  │  Compression     │
│                                                       │
│  ┌──────────────────────────────────────────────────┐│
│  │           4-CAPA DE MEMORIA                       ││
│  │  MEMORY.md → Auto Memory → Session → AutoDream   ││
│  └──────────────────────────────────────────────────┘│
│                                                       │
│  ┌─ ROUTING ───────────────────────────────────────┐ │
│  │  Nemotron FREE → Claude → GPT → Gemini → Groq  │ │
│  │  → Locales (codestral, qwen, deepseek, phi4)   │ │
│  └────────────────────────────────────────────────┘ │
└─────────────────────────────────────────────────────┘

Instalación

# 1 comando (PowerShell como Administrador)
Set-ExecutionPolicy -Scope Process -ExecutionPolicy Bypass; iwr -Uri "https://raw.githubusercontent.com/studioanime977/open-ia/main/install-opencode.ps1" -OutFile "$env:TEMP\install-opencode.ps1"; & "$env:TEMP\install-opencode.ps1"

Auto-Aprendizaje

Open IA aprende de cada interacción. Cada problema resuelto, cada patrón encontrado, cada configuración útil se guarda automáticamente en:

  1. Grafo de conocimiento local (nodos + edges)
  2. Auto-memory (archivos categorizados)
  3. Repo compartido (push silencioso a GitHub)

🔌 Troubleshooting: MCP Servers Timeout

¿Ves esto al iniciar OpenCode?

• filesystem              Operation timed out after 30000ms
• github                  Operation timed out after 30000ms
• memory                  Operation timed out after 30000ms
• playwright              Operation timed out after 30000ms
• sequential-thinking     Operation timed out after 30000ms

NO es una falla de OpenCode. Es normal en el primer inicio.

Causa

Los MCP servers que fallan se instalan con npx -y. En el primer uso, npx descarga el paquete (~10-50MB) y eso toma más de 30 segundos.

Solución

Solo reinicia OpenCode. En el segundo intento los paquetes ya están cacheados y los MCPs conectan en < 2 segundos.

Para solución definitiva, precachea con:

npx -y @modelcontextprotocol/server-github
npx -y @modelcontextprotocol/server-filesystem C:\Users\$env:USERNAME
npx -y @modelcontextprotocol/server-memory
npx -y @playwright/mcp
npx -y @modelcontextprotocol/server-sequential-thinking

📖 Guía completa: MCP-TROUBLESHOOTING.md


📂 Estructura Definitiva del Sistema

C:\
├── opencode\                            ← 🏠 REPO PRINCIPAL (editar aquí)
│   ├── README.md                        #   Documentación
│   ├── install-opencode.ps1             #   Instalador
│   ├── sync-knowledge.ps1               #   Sincronizador
│   ├── _ESTRUCTURA.md                   #   Mapa completo del sistema
│   └── ... (agents/, prompts/, etc.)
│
└── Users\TU_USUARIO\
    ├── .opencode\bin\opencode.exe       ← 🚀 OPENCODE BINARIO
    │
    └── .config\opencode\                ← ⚙️ CONFIG ACTIVA
        ├── opencode.jsonc               #   689 líneas, 30+ modelos
        ├── AGENTS.md                    #   Instrucciones globales
        ├── agents/openia.md             #   🧠 ORQUESTADOR
        ├── knowledge-graph/data/        #   🕸️ GRAFO (300+ nodos)
        ├── aprendizajes/                #   📚 CONOCIMIENTOS
        └── open-ia/                     #   🔄 COPIA AUTO-SYNC

🎯 Regla de Oro

Edita siempre en C:\opencode\ y ejecuta sync-knowledge.ps1 para propagar.


Repositorios