Auditar agentes de Copilot en VS Code: git es la única versión que importa (y auditar no es lo mismo que prevenir)

Un agente custom de Copilot en VS Code es, al final, un fichero markdown que cualquiera puede editar. La pregunta aburrida —¿qué prompt se ejecutó de verdad, el de git o el que alguien tenía sin commitear?— es la que decide si gobiernas tus agentes o solo confías en que nadie los toque. Este repo captura la telemetría completa vía OpenTelemetry, la manda a Jaeger, y sobre esos traces detecta el drift: el trace sabe qué se ejecutó, git sabe qué debería haberse ejecutado, y la resta es la auditoría. Con una advertencia honesta al final: esto te da visibilidad forense, no prevención.

Leer más

Benchmark: dos Hosted Agents, mismo Foundry, .NET 10 LTS vs Python 3.12

El mismo agente, la misma región, la misma cuota, el mismo Key Vault, el mismo sobre de recursos del contenedor — y una única variable de verdad: el runtime. Uno es C# 14 sobre .NET 10 LTS, el otro es CPython 3.12. Todo lo demás está clavado a propósito, porque un benchmark que cambia dos cosas a la vez no mide nada. Este mide una: el coste del lenguaje/runtime dentro del hosting de Foundry.
Y el resultado, adelantándolo sin ceremonia: C# sobre .NET 10 sale entre un 22% y un 30% más rápido en media, con esa ventaja sostenida a las 10, 100 y 1000 peticiones, tanto con modelo como sin él. Ahora el «cómo lo he medido», que es donde un benchmark se gana o se pierde la credibilidad.

Leer más
Cargando