#27 Lo divertido era que fuera 100% local y con medios restringidos, no tirar de servicios externos. Con pagar una api key de openAI y centrarme en la tokenización hubiera sacado un producto mil veces más potente.
hace tiempo leí un artículo de algún "experto" que recomendaba que fuese claude el mismo el que vaya tocando el .md, alguna idea?
#32 Mi Claude.md global es muy muy breve. Tiene 4 cosas y ya. Yo creo que donde la cosa debe brillar es en como la gente usa el claude local de cada proyecto + las normas que se pueden generar de forma local.
#34 El elefante en la habitación es que lo que mas importa es la codebase, si tu codebase es caca, Claude va a generar mas caca.
Ya puedes tener instalados todos los skills del marketplace.
#35 Correcto, aún así diría que te fijaras en tu claude.md dentro de Berrus, tengo un recuerdo de que era bastante largo, no? Qué cosas has ido recogiendo en él en este tiempo?
#36 En su dia lo tenia muy largo, pero movi mucho contexto (aka features) en skills, es algo que me funciona muy bien, ejemplo items tiene su propio skill, si necesita tocar cosas de items pues carga ese skill.
Este es el CLAUDE del proyecto, aparte del lore al principio el resto aplica a cualquier proyecto realmente:
Hay alguna cosa demasiado especifica y desactualizada diria a dia de hoy, pero el 95% lo veo bastante bien.
#37 Mola bastante. Más o menos es como recordaba con menos ruido. La parte de skills a cada parte del proyecto no la vi venir. Buenísima idea también. Toca aplicar. Gracias por compartir vidal!
Muy util, llevo una semana metiendole mas caña a claude pasando del pro a max (el de 200 euros no) y me viene bien ahora que estoy aprendiendo a configurarlo todo mejor.
Se nota el upgrade en el trabajo, el de 20 euro en una hora con sonnet me decía que esperase 4 horas de recarga y ahora voy full opus para tareas pesadas y no tengo narices a llegar al limite del día.
Lo malo de tener esta potencia de la IA noto que no soy capaz de desconectar del codigo porque como siempre está disponible para hacer cosas mi mente no puede parar de pensar cosas por flipao.
#41 si, el de 100 euros. Con el de 20 euros usaba sonnet 1 hora y tenía que esperar 4 o 5 horas y a los 3 o 4 días de uso intensivo en el trabajo me pedía esperar a la semana siguiente para que me reiniciase.
Ahora de momento no he llegado a ver un parón de tiempo en sesiones de 4-5 horas con el opus 4.6
#42 Por curiosidad ya que está habiendo muchas personas con problemas. En qué versión de Claude Code estás?
De la semana pasada a esta la cantidad que puedes consumir se ha rebajado un x3 mínimo. Por qué antes al de las 5 horas no lo consumía entera y ahora si.
Bastante vergonzoso pero bueno. Siguen echándole la culpa a los usuarios.
En mi opinión:
Sacaron un modelo con Opus 4.6 con 1M de tokens de ventana de contexto (x5 del límite anterior) --> la mayoría de tareas human-in-loop NO requieren esa cantidad de contexto. Y encima, tienen subagentes que precisamente están ideados para trabajar con la ventana de contexto limpia. No entiendo muy bien cuál fue la estrategia o necesidad de sacar un modelo así.
Mis ENV settings por si a alguien le sirven aunque estoy pensando en hacer downgrade a la versión 2.1.68 para que al menos Claude Code sea usable de forma sostenida.
CLAUDE_CODE_DISABLE_1M_CONTEXT=1 (esta es la más importante, reduce la ventana de contexto a 200k, nunca fue necesario el millón de tokens de contexto tbh).
CLAUDE_CODE_ATTRIBUTION_HEADER=0
CLAUDE_CODE_DISABLE_NONESSENTIAL_TRAFFIC=1
Sí, funciona. Es un kill-switch que deshabilita de un golpe todo el tráfico de red no esencial:
CLAUDE_CODE_NO_FLICKER=1
#46 a mí me resulta muy cómodo trabajar con opus[1m] pero rara vez paso del 20% de la ventana de contexto.
Lo bueno de tener una ventana de contexto tan grande a pesar de usar muy poco de ella es que mantiene una mejor calidad de las respuestas y me resulta más fácil hacer handover a otra sesión cuando veo que estoy usando más contexto del que quiero.
Cuando empecé a ver las quejas en Reddit por la gente que se quedaba sin uso pensaba que sería una combinación del uso de los modelos de 1M (por encima de los 200k tokens) junto con una degradación del CLAUDE.md, el repositorio y los archivos de memoria. Pero viendo el número de quejas parece claro que tiene que haber algo más.
Respecto a la memoria, ¿sabéis qué tal funciona auto-dream? Lo activé en cuanto lo vi pero no sabría decir si funciona bien.
#47 Yo creo que el problema nace de que la gente debe estar usando opus[1m] + subagentes en Opus también y el coste se va a la mierda. A parte de los bugs que ya tienen reportados desde la versión 2.1.69 en adelante hasta la actual que no han fixeado.
Por preguntarte @isvidal no tienes problemas de consumo de tokens tú que eres un power user y en tu empresa me imagino que habrá más users como tú? Habeís hecho downgrade a la versión 2.1.68, habéis limitado la ventana de contexto o simplemente os sigue funcionando bien?
#49 a ver yo siempre he pagado el de 200, desde hace ya facil 6 meses, con lo que nunca ( quizas 1 vez ) miro lo que consumo, para mi no es un pain point, asi que de estas cosas ni me entero.
Y sobre lo de 1 millón, personalmente me gusta mucho, antes cada dos por tres estabas compactando y ahora te puedes pasar un dia entero en una feature sin compactar y sin perdida de calidad.
Agent Team es otra cosa que se me había pasado mencionar y gasta una barbaridad. Cuando lo sacaron lo usé mucho y llegaba al límite con bastante facilidad aunque con una calidad muy buena.
Un día tenía tres terminales a la vez cada una con un agent team y en cosa de 30-60 minutos llegué al máximo de uso y las 5h me pasó otra vez lo mismo pero con todo ya terminado. Fue mucho gasto pero tener tres implementaciones en menos de dos horas totales no está mal.
Luego ya volví a tirar más de subagentes y solamente uso Agent Team cuando claramente necesito que se coordinen o veo que me va sobrar uso del semanal.
Tengo un premium seat en un team plan.
#50 Yo el tema es que veo a gente quejándose por x teniendo el plan de 200 y más users de mediavida igual. Cuenta el secreto haha
#52 tengo entendido que no es bug generalizado. En Reddit se ve que hay muchas quejas pero también hay mucha gente a la que no nos afecta. Yo personalmente no he notado absolutamente nada.
Yo he cambiado un poco el workflow, ahora leo ficheros con haiku, mil veces más rápido, planeo con opus, escribo con sonnet y las revisiones las vuelve a hacer opus.
No he notado ninguna pérdida de calidad respecto a ir full opus y es más rápido.
Mi próxima prueba será escribir con gpt con la licencia de 20 pavos q comparto con mi mujer a ver cuánto aguanta y q cambios noto.
Al final al usar opencode puedo mezclar fácil modelos sin problemas
#55 Ir full opus todo el rato no es lo optimo. Vas mas lento y gastas mas tokens para un mismo resultado.
Para la parte de scraping web, haiku va volando. No es necesario un modelo con thinking para la parte de leer docs o webs
#52 Estas ultimas semanas/dias no le estoy dando tanta caña que ando algo quemado, igual es por eso tambien.
#57 me alegra ver que no soy el único xD, aprovecho la senana santa para coger fuerzas y dejar de lado un poco la ia
Hay update de claude, la .91
Como tengo un rato, voy a pedirle un refactor gordo de una app a React + TypeScript, a ver que tal se comporta
#55 si le pides que explore un directorio o unos archivos directamente te lanza el subagente Explore, que usa Haiku.
Para las implementaciones lo mismo, el plan con Opus, la implementación con agentes usando Sonnet o Haiku y la ejecución de tests con Haiku.
Si quieres evitar usar Opus de más y te basta con usarlo para planificar puede tirar del modelo híbrido opusplan. Aunque yo no lo uso porque no lo tienen con la ventana de 1M.