Revisada el 2026-10-09 · vigente hasta 2027-01-07
Cline, agente de programación de código abierto para VS Code y el terminal, se vuelve lento cuando el modelo dedica mucho razonamiento a cada paso.12
Más razonamiento da respuestas más completas a cambio de tiempo y tokens.2 La receta mueve tres palancas: el nivel de razonamiento, el modelo de cada modo (Plan y Act) y, si se quiere ahorrar, un solo modelo para todo.
La ficha nace de una nota sin fuente. El 2026-10-09 se contrastó con la documentación de Cline y de OpenAI; lo que no se pudo confirmar lleva [cita requerida].
Requisitos
- Cline instalado. Hay extensión de VS Code, plugin de JetBrains, CLI y app de escritorio.1
- OpenAI configurado como proveedor, con clave de API o iniciando sesión con OpenAI Codex. Por esta segunda vía, los modelos disponibles dependen de tu plan.3
Pasos
- Abre los ajustes con el icono de engranaje del panel de Cline.3
- Aplica una de las opciones de abajo.
- Prueba con una tarea sencilla y compara el tiempo de respuesta.
Opción 1: bajar el razonamiento
- En la extensión, los modelos de razonamiento del catálogo de Cline muestran un control «Reasoning Effort» en el panel de ajustes.4
- En el CLI,
--thinkingfija el nivel:none,low,medium,highoxhigh. Sin valor, usamedium.5 - OpenAI reserva
nonepara tareas en las que la latencia manda y razonar no aporta, yxhighpara cuando las pruebas justifiquen la espera y el coste.2
Opción 2: un modelo rápido donde no hace falta pensar
- Activa «Use different models for Plan and Act» y elige un modelo para cada modo. Al cambiar de modo, Cline cambia de modelo solo.6
- La documentación propone un modelo que razone más para planificar y uno rápido para ejecutar. Su ejemplo de velocidad: Gemini 3 Flash en Plan y Cerebras en Act.6
- Con OpenAI, el modelo más eficiente hoy es GPT-6 Luna; GPT-6.1 Sol se acerca a Astra a menor coste.7
- La nota original proponía lo contrario: un modelo mini de OpenAI en Plan. Cline no lo recomienda en su documentación, y la gama principal de OpenAI (Astra, Sol y Luna) no incluye un modelo «mini».67
Opción 3: un solo modelo para ahorrar
- Deja desactivada la opción anterior: Plan y Act usan el mismo modelo.6
- Si ese modelo es barato, todo el trabajo sale barato. A cambio, renuncias a planificar con un modelo más fuerte, que es lo que sugiere Cline.6
- Si prefieres separar sin gastar, la documentación da una pareja orientada al coste: GLM 4.6 en Plan y Grok Code Fast en Act.6
Errores frecuentes
- Dejar el razonamiento alto en todas las tareas: era la causa de la lentitud según la nota, y encaja con lo que explica OpenAI.2
- Pedir un nivel que el modelo no admite. Los valores dependen del modelo; por ejemplo, GPT-6 Astra no acepta
none.2 - Con el proveedor «OpenAI Compatible» y un modelo fuera del catálogo, el control de razonamiento no aparecía. Cline cerró la incidencia el 2026-09-22 indicando pasar a su nueva arquitectura.4
Cómo lo uso
Sin uso propio documentado todavía.
Véase también
- Metodología de Claude Code
- Modelos de razonamiento
- Asistentes de programación
- Mejor modelo para cada tarea
Referencias
Footnotes
-
cline/cline. Cline Bot Inc., repositorio de GitHub. Consultado el 2026-10-09. ↩ ↩2
-
Reasoning models. OpenAI, documentación de la API. Consultado el 2026-10-09. ↩ ↩2 ↩3 ↩4 ↩5
-
OpenAI. Cline, documentación oficial. Consultado el 2026-10-09. ↩ ↩2
-
No way to set up Reasoning Efford for OpenAI Compatible provider in VS Code (#14146). Cline, incidencia de GitHub (Cline 4.1.17), cerrada el 2026-09-22. Consultado el 2026-10-09. ↩ ↩2
-
CLI Reference. Cline, documentación oficial. Consultado el 2026-10-09. ↩
-
Plan & Act Mode. Cline, documentación oficial. Consultado el 2026-10-09. ↩ ↩2 ↩3 ↩4 ↩5 ↩6
-
Models. OpenAI, documentación de la API. Consultado el 2026-10-09. ↩ ↩2