惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

美团技术团队
IT之家
IT之家
博客园 - Franky
博客园_首页
The Cloudflare Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
量子位
阮一峰的网络日志
阮一峰的网络日志
月光博客
月光博客
V
V2EX
Hugging Face - Blog
Hugging Face - Blog
博客园 - 三生石上(FineUI控件)
M
MIT News - Artificial intelligence
Engineering at Meta
Engineering at Meta
GbyAI
GbyAI
Stack Overflow Blog
Stack Overflow Blog
小众软件
小众软件
Jina AI
Jina AI
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
博客园 - 叶小钗
Apple Machine Learning Research
Apple Machine Learning Research
B
Blog RSS Feed

Все публикации подряд на Хабре

Ловим музу за клавиатуру: как айтишнику стать автором Что умеет Midjourney в 2026? Мой немного грустный разбор этого шикарного инструмента Никто не любит писать тесты, но ИИ может исправить это IPv8 выглядит как мечта. Поэтому почти наверняка не взлетит Производители вернули в продажу материнки с DDR3. Что происходит? Управление агентом с телефона через Telegram теперь в KodaCode От координации к лидерству: как меняется роль руководителя разработки Я сделала родителям бизнес вместо пенсии: зарабатываем 70 тысяч, мама не даёт продать В три раза быстрее приемка товара и оптимизация трудозатрат на 73%: как «РСТ-Инвент» помог Gulliver Group ИИ-шечный мир победил? О влиянии искусственного интеллекта на игропром Кремль снижает давление на Телеграмм пока Европа строит интернет по паспорту Как CEO, CTO и CIO за 8 часов собрали ИИ-директора, который умеет держать позицию под давлением Как (не) потерять домен за выходные Вместо 8 разных VPS: как я организовал практику студентам на одном сервере Почему твой Open Source проект не замечают? R&D: искусство управления неопределенностью в разработке AI-дефляция: вакансий для разработчиков больше, а рост зарплат — худший за 15 лет Мы отдали управление роботами OpenClaw. Что из этого вышло Галактический ID: система идентификации для всех форм разумной жизни Шесть основ бизнес-анализа: начинаем с вопроса «Кто в игре?» Код-ревью, в котором дело не в коде Данные переехали. Команда — нет Системной подход к сдаче OSWE в 2025 Почему комната управления реактором покрашена в цвет морской пены 4 YAML-файла вместо PySpark: как аналитикам строить пайплайны без разработчиков LLM-агент для поиска свободных доменов: автоматизируем подбор Когда, зачем и как правильно начинать новую сессию в Claude Code? Как я заставил нейросеть писать макросы для FreeCAD Анатомия ИИ‑агента для подбора персонала. От тысячи резюме к топ‑10 за минуты Опыт разработчика как экономика внимания
Skills исправляют привычки MCP исправляет память
DarkenAmber · 2026-06-23 · via Все публикации подряд на Хабре

Я долго пытался решить одну проблему Claude Code в разных сессиях ведет себя поразному и это иногда просто ломает логику работы

сначала думал что дело в промптах потом начал думать что проблема в контексте но в итоге стало понятно что все немного глубже

.

Что именно ломалось

больше всего бесило то что модель сама начинала “улучшать” код даже когда ее об этом вообще не просили

она могла убирать тесты потому что так якобы чище или менять архитектуру которая уже нормально работала и это выглядело странно

вторая проблема это память между сессиями мы вроде договорились как должен выглядеть проект но через день это уже просто забывается

третье это MCP инструменты которые постепенно превращаются в кашу и потом уже непонятно где логика а где данные

Я разделил систему на две части

сначала я пытался просто улучшать промпты но это довольно быстро перестало работать

тогда я разделил систему на Skills которые отвечают за поведение и MCP которые отвечают за память и инструменты

Skills и первая ошибка

Skill это просто SKILL.md файл и на первый взгляд это звучит очень просто

я сначала написал правило типа ship fast dont overthink и выглядело это нормально

но потом оказалось что модель начинает следовать этому слишком буквально

она начинала убирать тесты и упрощать код даже там где этого делать нельзя

Пришлось добавлять ограничения

после этого стало понятно что без явных ограничений это просто не работает нормально

я добавил правило Do NOT use when payments auth irreversible operations и только после этого стало хоть как то контролируемо

Баги которые меня реально удивили

один из первых багов был с asyncio и web сервером когда я просто соединил два подхода к event loop и все просто упало и сначала вообще непонятно было почему

потом была история с env переменными где ADMIN_IDS выглядели как обычная строка через запятую но pydantic ожидал json и все ломалось

самый неприятный баг был во Flutter когда длина строки считалась в символах а Google Drive ожидал байты и в итоге кириллица просто тихо обрезалась без ошибок

MCP и что там пошло не так

memory kit это просто SQLite с FTS5 чтобы можно было хранить и искать память локально идея простая но на удивление рабочая

skills server внезапно начал ловить проблему с параллельными запросами когда один skill дергается много раз одновременно и GitHub просто не выдерживает

пришлось добавить asyncio Lock чтобы это не разлеталось

github MCP сначала вообще не имел нормальной валидации и потом стало понятно что repo строку можно сломать через странный input

telegram MCP я сначала хотел делать с передачей токена как параметра но потом понял что это плохая идея и теперь токен живет только в env и вообще не попадает в модель

Проект пока сырой

я не пытаюсь делать вид что это какой то готовый фреймворк это скорее набор экспериментов который еще постоянно меняется

skills будут допиливаться MCP тоже будет меняться и возможно часть решений вообще окажется неправильной

Что дальше

планируется добавить - docs writer skill, test writer skill, новые MCP сервера и возможно mcpm как визуальный менеджер для всего этого

Итог

главное что я понял это то что проблема не в том что модель плохая а в том что у нее нет нормальных стабильных границ поведения и памяти

skills и MCP это просто попытка эти границы хоть как то зафиксировать


GitHub https://github.com/DarkenAmber/claude-kit