Invita y gana

Cómo funcionan las recompensas

Comparte tu enlace. Cuando un amigo se registre con él y recargue saldo, recibirás la recompensa indicada por sus recargas posteriores.

DeepSeek Harness: inicio, modos y límites de plugins

Un primer recorrido seguro de DeepSeek Harness: aislamiento, modos, Trajectory, auditoría de plugins y límites.

Índice

DeepSeek Harness: inicio, modos y límites de plugins

En resumen: DeepSeek Harness es un entorno de código abierto para componer un agente de programación a partir de partes reemplazables: modelo, herramientas, skills, sesión, sandbox, almacenamiento, bucle de agente, planificación e interfaz. No es simplemente un chat con modo agente. Como DeepSeek lo publica como Developer Preview, la primera meta razonable es una ejecución observable y de solo lectura en una carpeta aislada, no un despliegue sobre un repositorio de producción.

La fórmula de DeepSeek es Agent = Model + Harness. El modelo genera y razona; el harness aporta contexto de entorno, herramientas y el ciclo de ejecución. Si el agente lee el archivo incorrecto, ignora la salida de un comando o escribe donde no debía, la causa puede ser el runtime o el contexto, no únicamente el modelo.

Para conectar un modelo mediante un endpoint API personalizado, primero confirma el protocolo, la Base URL y la autenticación del proveedor. BetterToken ofrece interfaces OpenAI-compatible y Anthropic-compatible para herramientas que admiten una Base URL propia, pero eso no prueba compatibilidad con todos los plugins de Harness. Comprueba el esquema del proveedor y tu clave en la documentación API de BetterToken y haz después una tarea pequeña de solo lectura.

Qué ofrece el proyecto y cuál es su límite

El repositorio oficial de DeepSeek Harness tiene licencia MIT y se apoya en Cordis. La idea central es que todo es un plugin. Cordis carga, descarga y resuelve dependencias; las capacidades concretas del agente proceden de plugins de modelo, herramientas, sesión, sandbox, almacenamiento, interfaz y otras capas.

La modularidad permite aislar cambios. Puedes comparar un modelo sin cambiar a la vez la capa de herramientas, o revisar el efecto de una sesión sin reconstruir todo el runtime. A cambio, cada plugin puede ampliar los datos disponibles, los permisos, las dependencias o los servicios externos que el agente alcanza.

Developer Preview no es un detalle de marketing. DeepSeek avisa de cambios incompatibles mientras el proyecto itera rápido. No conviertas una opción copiada de un tutorial antiguo en una configuración permanente. Antes de tocar información real, confirma los requisitos en el quickstart oficial y en el README actual.

Primer inicio: una prueba reversible antes de una tarea real

Instala la versión de Node.js indicada por la documentación vigente y ejecuta el comando oficial:

npx @deepseek-ai/dsh web

El comando inicia una interfaz web local. Si necesitas arrancar el servidor sin abrir un navegador automáticamente, usa la opción —no-open. El proyecto también explica cómo ejecutar desde el código fuente, pero no es necesario para confirmar el comportamiento básico.

Usa este orden para la primera sesión:

  1. Crea una carpeta vacía o un clon limpio sin secretos, cookies, archivos .env ni trabajo sin confirmar.
  2. Abre la interfaz y selecciona Standard. No añadas plugins comunitarios todavía.
  3. Pide una tarea limitada: encontrar el punto de entrada, explicar la estructura del proyecto o preparar un plan, sin escribir archivos.
  4. Compara la respuesta con los archivos y con los eventos de la sesión. Solo entonces permite una modificación pequeña y revisa el diff.

Una carpeta aislada no convierte el shell en seguro. Es una medida que reduce el alcance de una mala configuración y ayuda a distinguir un fallo de contexto de un daño en el repositorio principal. Si la primera prueba exige una credencial de producción, no sigas: la validación inicial debe poder hacerse sin ella.

Los cuatro modos y la pregunta que responde cada uno

ModoCapacidadesCuándo elegirloQué comprobar primero
StandardEdición de archivos, shell, búsquedas, skills, planes, objetivos, subagentes y workflowsUna tarea común de desarrolloHerramientas disponibles y acciones que realmente corrieron
PTCStandard más Code Mode SDK para componer llamadas en TypeScriptUna secuencia repetida cuya orquestación debe revisarseEl TypeScript generado y el límite de cada llamada
MinimalBash persistente y str_replace_editorUna baseline de diagnóstico o benchmarkQué cambia sin capas adicionales
CreationStandard más inspección del runtime, experimentos Cordis en memoria y presetsDiseñar un preset propioPlugins, dependencias y permisos que suma el preset

Standard es el punto de partida práctico. Enseña el ciclo completo de un agente sin obligarte a programar la orquestación. Aun así, revisa las herramientas expuestas: que una herramienta exista no significa que deba usar datos sensibles.

PTC sirve cuando la cadena de llamadas es parte de lo que quieres auditar. El modelo compone un programa TypeScript que enlaza herramientas. Puede hacer el procedimiento más legible y reproducible, pero no garantiza una respuesta mejor ni una ejecución segura. Revísalo como un script: entradas, archivos tocados, llamadas externas y condición de parada.

Minimal no es un Standard ligero para el uso diario, sino una referencia para medir la influencia de skills, búsquedas, interfaz y orquestación. Creation tiene sentido después de entender la configuración vigente: es el lugar para crear un preset, no para omitir la verificación de un preset existente.

Trajectory: audita el recorrido, no solo la respuesta final

DeepSeek describe Trajectory como un registro append-only de la sesión. Puede contener el prompt de sistema, el contexto visible para el modelo, las llamadas de herramientas y resultados, la planificación de subagentes y las inyecciones de contexto. Recovery, branching, búsqueda y replay usan el mismo flujo.

Después de la primera tarea, responde desde el registro:

  • ¿Qué archivos y qué salidas de comandos vio realmente el agente?
  • ¿Entró contexto inesperado o se hizo una llamada de herramienta no prevista?
  • ¿El proceso se detuvo por permisos, herramienta ausente, instrucciones o contexto?
  • ¿La trayectoria que funcionó se puede repetir sin empezar una conversación vacía?

Prueba a pedir dónde se construye una configuración y prohíbe escribir. Luego contrasta ruta, comando y salida con Trajectory. Si no corresponden al repositorio, no intentes arreglarlo cambiando el prompt: corrige primero acceso y contexto. El registro es una ayuda de auditoría, no un sitio para guardar secretos, prompts confidenciales o logs completos de producción.

Plugins, permisos y configuración: añade una capacidad con un plan de vuelta

Un plugin es código con dependencias y superficie de acceso, no una casilla inocente. Antes de instalarlo, registra cuatro cosas:

  1. la capacidad concreta que falta;
  2. los archivos, datos, servicios y permisos que puede alcanzar;
  3. la señal que indicará una regresión;
  4. el modo de volver al preset anterior.

DeepSeek ofrece el tema comunitario dsh-plugin para descubrir extensiones. Lee código fuente y dependencias antes de instalar un bundle. Durante el Preview cambia solo un componente por ejecución; si cambias modelo, herramientas y plugins juntos, Trajectory no podrá mostrar qué causó el resultado.

Concede permisos mínimos. La carpeta de prueba no vuelve seguro a un plugin ni a una orden de shell. No habilites despliegues, migraciones, acceso a secretos o escritura amplia porque la tarea inicial sea simple. No pongas API keys, cookies o archivos .env en un preset, prompt o trayectoria. Si una prueba autorizada necesita un proveedor, usa tu propia cuenta y clave, limítala al test y elimínala del directorio temporal después de revisar el resultado.

Validación, diagnóstico y adopción

Una validación mínima necesita tres evidencias: la tarea fue entendida, las acciones registradas coinciden con los archivos reales y una persona revisó el diff o la salida. Después aumenta una sola variable: permite escritura en una rama desechable, incorpora una herramienta y luego prueba un plugin.

Clasifica los problemas antes de cambiar el preset:

  • No aparece el archivo correcto: revisa directorio de trabajo, permisos de lectura y contexto proporcionado.
  • La salida del comando no coincide con la respuesta: comprueba el evento de Trajectory, la versión de la herramienta y la salida real antes de atribuirlo al modelo.
  • El proveedor no responde: vuelve a validar protocolo, Base URL, autenticación y modelo con su documentación. Un solo error no demuestra incompatibilidad de un plugin.
  • El plugin amplía demasiado el acceso: desactívalo, vuelve al preset anterior y reproduce la tarea sin él.

Harness vale la pena cuando necesitas separar comportamiento del modelo y herramientas, depurar un flujo de varios pasos con eventos o construir un preset reproducible. Aplaza datos reales si no tienes entorno desechable, revisión de diffs y un proceso para leer logs.

Para separar el acceso API de tus suscripciones y comprobar estado y consumo en una prueba autorizada, crea tu propia clave en BetterToken, sigue la documentación API de BetterToken y empieza con una tarea Harness breve y de solo lectura. Mantén las URLs de documentación y configuración sin parámetros UTM.

¿Quieres optimizar tu flujo de trabajo con LLM?

Conecta modelos mediante una API, gestiona claves y controla el gasto en IA.

Empezar gratis