惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

T
Tailwind CSS Blog
博客园 - Franky
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Y
Y Combinator Blog
Hugging Face - Blog
Hugging Face - Blog
博客园 - 聂微东
L
LangChain Blog
博客园_首页
Recent Announcements
Recent Announcements
月光博客
月光博客
酷 壳 – CoolShell
酷 壳 – CoolShell
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
H
Hackread – Cybersecurity News, Data Breaches, AI and More
爱范儿
爱范儿
博客园 - 叶小钗
博客园 - 【当耐特】
The Cloudflare Blog
J
Java Code Geeks
G
Google Developers Blog
云风的 BLOG
云风的 BLOG
Blog — PlanetScale
Blog — PlanetScale
博客园 - 司徒正美
aimingoo的专栏
aimingoo的专栏
A
About on SuperTechFans

Все публикации подряд на Хабре

Ловим музу за клавиатуру: как айтишнику стать автором Что умеет Midjourney в 2026? Мой немного грустный разбор этого шикарного инструмента Никто не любит писать тесты, но ИИ может исправить это IPv8 выглядит как мечта. Поэтому почти наверняка не взлетит Производители вернули в продажу материнки с DDR3. Что происходит? Управление агентом с телефона через Telegram теперь в KodaCode От координации к лидерству: как меняется роль руководителя разработки Я сделала родителям бизнес вместо пенсии: зарабатываем 70 тысяч, мама не даёт продать В три раза быстрее приемка товара и оптимизация трудозатрат на 73%: как «РСТ-Инвент» помог Gulliver Group ИИ-шечный мир победил? О влиянии искусственного интеллекта на игропром Кремль снижает давление на Телеграмм пока Европа строит интернет по паспорту Как CEO, CTO и CIO за 8 часов собрали ИИ-директора, который умеет держать позицию под давлением Как (не) потерять домен за выходные Вместо 8 разных VPS: как я организовал практику студентам на одном сервере Почему твой Open Source проект не замечают? R&D: искусство управления неопределенностью в разработке AI-дефляция: вакансий для разработчиков больше, а рост зарплат — худший за 15 лет Мы отдали управление роботами OpenClaw. Что из этого вышло Галактический ID: система идентификации для всех форм разумной жизни Шесть основ бизнес-анализа: начинаем с вопроса «Кто в игре?» Код-ревью, в котором дело не в коде Данные переехали. Команда — нет Системной подход к сдаче OSWE в 2025 Почему комната управления реактором покрашена в цвет морской пены 4 YAML-файла вместо PySpark: как аналитикам строить пайплайны без разработчиков LLM-агент для поиска свободных доменов: автоматизируем подбор Когда, зачем и как правильно начинать новую сессию в Claude Code? Как я заставил нейросеть писать макросы для FreeCAD Анатомия ИИ‑агента для подбора персонала. От тысячи резюме к топ‑10 за минуты Опыт разработчика как экономика внимания
Как Gemini CLI поймал у моего Claude Code критическую дыр...
anydasa · 2026-04-26 · via Все публикации подряд на Хабре

Уровень сложностиПростой

Время на прочтение5 мин

Охват и читатели403

Туториал

Recovery Mode

Solo-фаундер. Делаю всё через Claude Code. На прошлой неделе он спроектировал мне систему loyalty-кредитов, я её четыре раза перечитал и собрался релизить. Сказал Claude: «обсуди это с Gemini». Через 30 секунд получил ответ, что я в буквальном смысле платил юзерам за то, чтобы они НЕ подписывались.

Что сломалось

Дизайн: юзер дочитывает книгу → получает бонусные credits на дальнейшее чтение. Cap на гранты — 1 раз в неделю. Я выбрал формулу:

Linear cap: min(pages × 3, 600)

Посчитал paywall:

  • Cap 600 × 4 недели = 2400/мес максимум

  • Premium Basic = 3000/мес

  • 2400 < 3000 → paywall сохранён.

Логично? Логично. Сказал Claude: «обсуди этот дизайн с Gemini». Через 30 секунд получил:

VERDICT — GOOD WITH FIXES

2. Paywall Risk: CRITICAL FAILURE.
   Max free potential = 250 (monthly) + 1500 (daily refills) +
   2400 (4× 600 grants) = 4150 credits/mo.
   Your Premium Basic is 3000.
   You are literally paying users to NOT subscribe.
   Grant must not exceed 250-300 per week.

5. Abuse Vectors: You missed "Speed Flipping."
   If completion is just reaching the last page, a user will
   swipe through a 200p book in 60 seconds to farm 600 credits.
   Need min 3 seconds/page check.

SINGLE MOST IMPORTANT FIX: Reduce grant cap to 300 credits/week.

Я забыл daily refill в своей mental model. 1500 невидимых credits/мес. Полный потолок free = 4150 — выше Premium на 38%. Free выходил выгоднее платного. Я бы катил это в прод.

Бонус: speed-flipping exploit, который я не рассмотрел вообще. Кто-то напишет скрипт, прокрутит 200-страничную книгу за 60 секунд, нафармит 600 credits. Очевидно постфактум, не очевидно изнутри собственного дизайна.

Один запрос — два critical bug'а до релиза. 30 секунд. $0.

Зачем нужен второй ИИ как ревьюер

В апреле 2025-го Дмитрий Дементьев на Хабре показал паттерн: один ИИ ревьюит работу другого через CLI. Идея сильная — разные RLHF-приоры → разные blind spots → cross-model критика ловит то, что self-critique структурно пропускает.

Узкое место его подхода: Codex CLI требует платный OpenAI API. Solo-фаундер начинает скупиться, использует редко.

Gemini CLI снимает это:

  • OAuth через Google-аккаунт (никаких API ключей)

  • 1000 запросов в день бесплатно

  • Контекст 1M токенов (читает PDF до 1000 страниц нативно)

  • Другой вендор — другие RLHF-приоры — другие находки

Как я это делаю

Сразу честно: я не формулирую prompt вручную. Я не сижу и не пишу «context: …, audience: …, anti-criteria: …». Я говорю Claude:

«Обсуди это с Gemini».

Дальше Claude сам собирает prompt со всем контекстом сессии (артефакт, аудитория, цифры, что я уже отверг и почему), запускает gemini, возвращает мне verbatim critique. Я просто читаю результат.

Это работает, потому что у Claude Code на эту задачу повешен skill: маленький markdown-файл, в котором описано, как ловить триггер («обсуди с Gemini» / «second opinion»), как структурировать запрос и какие anti-patterns избегать (например, не упоминать «Claude wrote this» — это смещает critique).

Skill открытый, MIT, лежит в github.com/anydasa/claude-skills. Положили в репо сегодня. Установка — два файла: SKILL.md в .claude/skills/gemini-review/, и gemini auth login для OAuth. Дальше Claude Code сам делает всё остальное.

Финальные правки в дизайн после Gemini

Параметр

Было

Стало

Formula

min(pages×3, 600)

min(pages×3, 300)

Speed-flip защита

нет

min 3s/страница ИЛИ ≥80% страниц открыто

Level-up trigger

открыл новый CEFR

прочитал ≥10 страниц или ≥10% книги на новом уровне

С чем не согласился: Gemini предложил перевести copy в gamer-tone («B1 unlocked. A2 is beneath you now»). Для аудитории взрослых читателей классики на иностранных языках это пахнет Duolingo, ломает positioning. Cross-model ревью — это suggestion, не приказ. Founder судит, что применять.

Track-record

Чтобы skill не превратился в pseudo-rigor оправдание для shipping:

  • <60% suggestions applied → judge sycophancy-noisy, tighten criteria

  • >90% applied → underusing own judgment, audit

  • 60-90% → healthy zone

За три недели — 4 invocation'а, 4 материальных catch'а:

  • Loyalty-credit design (выше) — paywall math + speed-flip exploit

  • Partner-program PDF — caught missing founder presence

  • Pricing strategy — caught mis-framing translation as premium feature

  • Architecture proposal — flagged "drop economy" as the one critical pre-launch decision

Все — freeform strategic артефакты. На код с тестами skill не используется: тесты и есть judge.

А эта статья — её писал ИИ?

Конечно. Иронично было бы пытаться скрыть. Драфт сделал Claude Code, потом я её прочитал, отредактировал, поправил тон, переставил абзацы, выкинул половину технических деталей.

Это и есть рабочий human-in-the-loop: AI пишет первый драфт, человек правит, второй AI ревьюит итог. Эту статью я тоже прогнал через Gemini перед публикацией — он подсказал убрать одну секцию, которая выглядела как самореклама.

Что не помешало написать про себя в footer'е :)

Чем я сегодня занимался — для иллюстрации скорости

Эта статья — побочный продукт обычного утра. Чтобы было понятно, что входит в «обычное утро» с Claude Code, вот фактический git-лог за сегодня (4 часа, до обеда):

В продуктовом репо (бэкенд + Telegram Mini App):

  • feat(credits) — динамическая награда за дочитывание книги + транзакционные нотификации

  • feat(admin) — lifetime reading-time в админке + бэкфилл из истории

  • fix(chunk-analyzer) — per-target_lang кэш + native-slot labels + консолидация промптов

  • feat(credits) — снижение signup-бонуса 1000 → 250 + сжатие non-premium балансов

  • feat(onboarding) — дефолтный CEFR-уровень A2 вместо B1

Параллельно в маркетинг/ресёрч-репо:

  • Partner-program PDF (8 страниц) для outreach к Telegram-creator'ам — драфт, ревью Gemini, фиксы по результатам ревью, рендер через headless Chrome

  • Эта статья на Хабре — драфт, ревью Gemini

  • LinkedIn-пост — три версии (EN-personal, EN-insight, RU)

  • Опубликовали github.com/anydasa/claude-skills с MIT-лицензией

  • Десяток обновлений в memory-файлах

Это не sprint-режим под дедлайн. Это обычное утро при тарифе Claude Code Max за $200/месяц. В лимиты ни разу не упирался, хотя пару раз подходил близко к недельному. На solo-bootstrap это, пожалуй, лучший $200, которые я вообще трачу — за эту цену я получаю эквивалент middle-разработчика на full-time, которому дополнительно можно поручить partner-PDF, Habr-статью и SQL-запрос в analytics между делом.

Контекст для тех, кто сравнивает: я не ML-инженер, не профессиональный маркетолог и не профессиональный copywriter. Английский — B1+, выучил сам. То, что вы читаете — типичный солист с продуктовым бэкграундом, который раньше делал три из этих десяти вещей вручную, плохо, и редко.

Cross-model judge — один из инструментов в этом setup. Не магия, но кратно поднимает уверенность в freeform-артефактах, которые иначе пришлось бы либо катать на удачу, либо платить $300/час консультанту.

О себе

Делаю Osmo Lingo — Telegram Mini App и Web Application для чтения классики на иностранных языках с AI-адаптацией под уровень.

Solo-founder. Лечу как ракета: десятки исследований и экспериментов, ежедневные столкновения с проблемами, разочарованиями, неуверенностью. Иногда честно хочется всё бросить. Если интересно, как я прохожу этот путь — задавайте вопросы в комментариях, расскажу о неудачах, поворотах и что реально работает на solo-стадии.

Ссылки: