Chat, Agente y Planificar
Los tres modos, cuánto razonamiento comprar y cómo reconducir o detener un turno que ya está en marcha.
El modo decide cuánto puede hacer Kosmo por su cuenta. El control está en el compositor, junto al selector de modelo.
Los tres modos
Chat habla. Lee el proyecto y responde, y no cambia nada.
Agente ejecuta. Lee, escribe, edita y lanza comandos para terminar lo que le has pedido, contando lo que hace mientras lo hace. Es el modo predeterminado.
Planificar diseña primero. Crea un plan versionado vinculado a la evidencia usada y espera. La aprobación se aplica a esa revisión exacta y la entrega a Agente. Si falta evidencia relevante, está obsoleta o cambia antes de ejecutar, Kosmo bloquea la acción afectada o pide que la vuelvas a validar.
Recurre a Planificar cuando la tarea sea lo bastante grande como para que un giro equivocado salga caro, y a Agente cuando no lo sea.
Nota: Planificar y Agente necesitan un modelo que admita herramientas. Con un modelo de solo chat el control de modo lo indica.
Nivel de razonamiento
Al margen del modo, puedes elegir cuánto razona un modelo antes de responder, desde la barra del chat o desde Configuración → IA. El ajuste es por modelo y se aplica al chat, al asistente flotante y al widget de chat del panel.
| Nivel | Cuándo usarlo |
|---|---|
| Auto | Deja decidir al modelo. Un buen valor por defecto |
| Off | Responde de inmediato, sin razonar |
| Mínimo / Bajo | Preguntas cortas cuya respuesta es consulta, no razonamiento |
| Medio | Un equilibrio válido para la mayoría de preguntas |
| Alto / Muy alto | Problemas difíciles que compensan la espera |
| Máximo | El razonamiento más profundo que ofrece el modelo |
Razonar más es más lento y gasta más créditos. No todos los modelos ofrecen la escala completa: algunos se detienen antes, otros razonan siempre y no hay nada que ajustar, y otros no lo admiten. El control te dice en qué caso estás.
Mientras trabaja
No tienes que quedarte esperando. Sigue escribiendo: lo que envías espera su turno por defecto. Si hace falta ya, empújalo dentro del trabajo en curso con Enviar a este turno y el agente lee tu corrección entre llamadas a herramientas, en lugar de terminar primero lo que no tocaba.
Detener cierra el turno. El trabajo parcial no se pierde: la respuesta hasta ese punto, el razonamiento y la secuencia de herramientas quedan guardados, así que un turno interrumpido aparece en la conversación como interrumpido en lugar de desaparecer.
Permisos para los comandos
En modo Agente y Planificar, cualquier cosa que ejecute código en tu ordenador pregunta antes. Revisa los argumentos y elige Permitir una vez, Permitir siempre, Permitir siempre para toda la familia de comandos, o Denegar.
Algunos comandos nunca se pueden memorizar y preguntan todas las veces: operaciones destructivas del sistema de archivos como rm -rf, dd, mkfs y shred; elevación de privilegios como sudo, su y doas; y cambios permanentes del sistema como chmod -R, chown -R, systemctl y kill.
Cuando la conversación se alarga
Las conversaciones largas se compactan solas. También puedes compactar a demanda desde el control de contexto: resume la parte inicial de la conversación y libera espacio para el resto. El contexto tiene que estar lleno al menos al 10% para que haya algo que compactar.