惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Hugging Face - Blog
Hugging Face - Blog
量子位
H
Help Net Security
Microsoft Azure Blog
Microsoft Azure Blog
MongoDB | Blog
MongoDB | Blog
小众软件
小众软件
爱范儿
爱范儿
博客园 - 【当耐特】
Vercel News
Vercel News
S
SegmentFault 最新的问题
M
MIT News - Artificial intelligence
F
Fortinet All Blogs
Apple Machine Learning Research
Apple Machine Learning Research
GbyAI
GbyAI
博客园 - 叶小钗
博客园_首页
V
Visual Studio Blog
宝玉的分享
宝玉的分享
B
Blog
MyScale Blog
MyScale Blog
C
Check Point Blog
博客园 - 三生石上(FineUI控件)
L
LangChain Blog
V
V2EX

DEV Community

Authentication Security Deep Dive: From Brute Force to Salted Hashing (With Java Examples) Why AI Systems Don’t Fail — They Drift Spilling beans for how i learn for exam😁"Reinforcement Learning Cheat Sheet" I Replaced Chrome with Safari for AI Browser Automation. Here's What Broke (and What Finally Worked) How Python Borrows Other People's Work The $40 Architecture: Processing 1 Billion API Requests with 99.99% Uptime Vibe Coding: A Workflow Guide (From Zero to SaaS) Most webhook security guides protect the wrong side. The scary part is delivery. Headless CMS for TanStack Start: Build a Blog with Cosmic EU Age Verification App "Hacked in 2 Minutes" — What Actually Happened Comfy Cloud’s delete function does not actually remove files Running AI Models on GPU Cloud Servers: A Beginner Guide Event-driven media intelligence with AWS Step Functions and Bedrock I scored 500 AI prompts across 8 quality dimensions — here's what broke How to Call Google Gemini API from Next.js (Free Tier, No Backend Needed) The Portal Protocol: Reclaiming Human Connection in the Age of AI How to Fix Your Team's Scattered Knowledge Problem With a Self-Hosted Forum Intro to tc Cloud Functors: A Graph-First Mental Model for the Modern Cloud Designing Multi-Tenant Backends With Both Ownership and Team Access I Built a Neumorphic CSS Library with 77+ Components — Here's What I Learned PostgreSQL Performance Optimization: Why Connection Pooling Is Critical at Scale Cómo construí un SaaS multi-rubro para gestionar expensas en Argentina con FastAPI + Vue 3 🚀 I Built an Ethical Hacking Scanner Tool – Open Source Project I Replaced /usage and /context in Claude Code With a Single Statusline A Pythonic Way to Handle Emails (IMAP/SMTP) with Auto-Discovery and AI-Ready Design I Collected 8.9 Million Polymarket Price Points — Here's What I Found About How Markets Really Move EcoTrack AI — Carbon Footprint Tracker & Dashboard Everyone's Using AI. No One Agrees How. 5 self-hosted ebook managers worth trying in 2026 Building Your First AI Agent with LangChain: From Chatbot to Autonomous Assistant
🚀 Cómo dejar de quemar tokens en tu IDE con AI
Johan Fabi · 2026-05-10 · via DEV Community

Johan Fabi

🤔 Introducción

La época del “AI coding ilimitado” se está terminando.

Herramientas como GitHub Copilot, Claude Code y otros IDEs con AI están moviéndose cada vez más a modelos por consumo (tokens, créditos, uso real).

Y eso cambia las reglas del juego.

Lo que antes daba lo mismo, mandar todo el repo, chats largos, prompts vagos, ahora tiene un costo directo en:

  • Dinero.
  • Latencia.
  • Calidad de respuesta.

En simple:

Ya no basta con escribir buen código, ahora también hay que usar y administrar bien los tokens y la AI.

En esta guía te dejo prácticas concretas para gastar menos tokens sin perder productividad.


⚙️ El problema

Cosas que todos hacemos (y salen caras):

  • “Toma, te paso todo el repo”.
  • Prompts tipo “mejora esto”.
  • Chats eternos de 40 mensajes.
  • Esperar que el agente piense todo por ti.

Resultado:

  • Respuestas lentas.
  • Más gasto.
  • Código inconsistente.

🛠️ La solución (forma simple)

1. No lo hagas pensar todo desde cero

Antes de usar el IDE:

  • Define qué quieres.
  • Escribe un mini plan.
  • Usa las Specs.

Ejemplo:

  • requirements.md
  • design.md
  • tasks.md

Luego:

“Implementa esta tarea específica” o
“Ejecuta la spec”


2. Trabaja en cosas chicas

  • Una feature = una sesión
  • Terminas → Cierras → Sigues

3. No le mandes de más

Evita:

  • Logs largos.
  • Archivos irrelevantes.
  • Todo el repo.

4. Sé claro (muy claro)

❌ “Mejora esto”.
✅ “Haz esta función más rápida y no cambies lo demás”.


5. Resume y sigue

En vez de arrastrar todo el chat o dejar que recuerde el contexto, mejor dile exactamente dónde estás parado.

En vez de esto:

“Ahora agrega login considerando todo lo anterior.”

Haces esto:

Estado actual:

  • API (Funciona)
  • /users (Listo)
  • Código (Limpio)

Qué falta:

  • Login con JWT.

Qué necesito:

  • Endpoint /login
  • Validación básica.
  • No tocar lo demás.

6. Prueba tú, no el agente

  • Corre tests tú.
  • Compila tú.

Y pasa solo errores relevantes.


7. Pide solo cambios

No pidas archivos completos si no es necesario.

Mejor:

“Dime qué cambiar”


8. Corta chats largos

  • Resume.
  • Reinicia.
  • Sigue.

9. Usa siempre la misma estructura

Contexto:
Objetivo:
Restricciones:
Qué necesito:

Enter fullscreen mode Exit fullscreen mode


💻 Ejemplo

❌ Malo

Analiza todo el repo y mejóralo.

Enter fullscreen mode Exit fullscreen mode


✅ Bueno

Contexto:
user.service.ts

Objetivo:
Mejorar getUsers()

Restricciones:
No tocar otros archivos

Qué necesito:
Solo los cambios

Enter fullscreen mode Exit fullscreen mode


⚠️ Errores típicos

  • Pensar que “más contexto = mejor resultado”.
  • No cerrar conversaciones.
  • Ser poco claro en los prompts.

✅ Qué te deberías llevar como aprendizaje

  • No hagas que el agente piense todo.
  • Dale solo lo justo.
  • Trabaja en cambios pequeños.
  • Sé directo.
  • Corta cuando se alarga.

🧾 En Resumen

Usa el agente como ejecutor, no como cerebro principal.