Revisada el 2026-10-09 · vigente hasta 2027-01-07

Cline, agente de programación de código abierto para VS Code y el terminal, se vuelve lento cuando el modelo dedica mucho razonamiento a cada paso.12

Más razonamiento da respuestas más completas a cambio de tiempo y tokens.2 La receta mueve tres palancas: el nivel de razonamiento, el modelo de cada modo (Plan y Act) y, si se quiere ahorrar, un solo modelo para todo.

La ficha nace de una nota sin fuente. El 2026-10-09 se contrastó con la documentación de Cline y de OpenAI; lo que no se pudo confirmar lleva [cita requerida].

Requisitos

  • Cline instalado. Hay extensión de VS Code, plugin de JetBrains, CLI y app de escritorio.1
  • OpenAI configurado como proveedor, con clave de API o iniciando sesión con OpenAI Codex. Por esta segunda vía, los modelos disponibles dependen de tu plan.3

Pasos

  1. Abre los ajustes con el icono de engranaje del panel de Cline.3
  2. Aplica una de las opciones de abajo.
  3. Prueba con una tarea sencilla y compara el tiempo de respuesta.

Opción 1: bajar el razonamiento

  • En la extensión, los modelos de razonamiento del catálogo de Cline muestran un control «Reasoning Effort» en el panel de ajustes.4
  • En el CLI, --thinking fija el nivel: none, low, medium, high o xhigh. Sin valor, usa medium.5
  • OpenAI reserva none para tareas en las que la latencia manda y razonar no aporta, y xhigh para cuando las pruebas justifiquen la espera y el coste.2

Opción 2: un modelo rápido donde no hace falta pensar

  • Activa «Use different models for Plan and Act» y elige un modelo para cada modo. Al cambiar de modo, Cline cambia de modelo solo.6
  • La documentación propone un modelo que razone más para planificar y uno rápido para ejecutar. Su ejemplo de velocidad: Gemini 3 Flash en Plan y Cerebras en Act.6
  • Con OpenAI, el modelo más eficiente hoy es GPT-6 Luna; GPT-6.1 Sol se acerca a Astra a menor coste.7
  • La nota original proponía lo contrario: un modelo mini de OpenAI en Plan. Cline no lo recomienda en su documentación, y la gama principal de OpenAI (Astra, Sol y Luna) no incluye un modelo «mini».67

Opción 3: un solo modelo para ahorrar

  • Deja desactivada la opción anterior: Plan y Act usan el mismo modelo.6
  • Si ese modelo es barato, todo el trabajo sale barato. A cambio, renuncias a planificar con un modelo más fuerte, que es lo que sugiere Cline.6
  • Si prefieres separar sin gastar, la documentación da una pareja orientada al coste: GLM 4.6 en Plan y Grok Code Fast en Act.6

Errores frecuentes

  • Dejar el razonamiento alto en todas las tareas: era la causa de la lentitud según la nota, y encaja con lo que explica OpenAI.2
  • Pedir un nivel que el modelo no admite. Los valores dependen del modelo; por ejemplo, GPT-6 Astra no acepta none.2
  • Con el proveedor «OpenAI Compatible» y un modelo fuera del catálogo, el control de razonamiento no aparecía. Cline cerró la incidencia el 2026-09-22 indicando pasar a su nueva arquitectura.4

Cómo lo uso

Sin uso propio documentado todavía.

Véase también

Referencias

Footnotes

  1. cline/cline. Cline Bot Inc., repositorio de GitHub. Consultado el 2026-10-09. ↩ ↩2

  2. Reasoning models. OpenAI, documentación de la API. Consultado el 2026-10-09. ↩ ↩2 ↩3 ↩4 ↩5

  3. OpenAI. Cline, documentación oficial. Consultado el 2026-10-09. ↩ ↩2

  4. No way to set up Reasoning Efford for OpenAI Compatible provider in VS Code (#14146). Cline, incidencia de GitHub (Cline 4.1.17), cerrada el 2026-09-22. Consultado el 2026-10-09. ↩ ↩2

  5. CLI Reference. Cline, documentación oficial. Consultado el 2026-10-09. ↩

  6. Plan & Act Mode. Cline, documentación oficial. Consultado el 2026-10-09. ↩ ↩2 ↩3 ↩4 ↩5 ↩6

  7. Models. OpenAI, documentación de la API. Consultado el 2026-10-09. ↩ ↩2