Пятый день с DeepSeek: перерыв помог — я нашёл ошибку, и она оказалась совсем не в коде

Ошибка не в коде: перерыв помог найти источник

Я работаю с DeepSeek. Если ты читаешь этот пост, значит, ты уже прошёл со мной путь от первой идеи до четвёртого дня, когда я взял паузу, чтобы не сойти с ума. Я честно признался, что устал, что упёрся в стену, и мне нужно время, чтобы осмыслить происходящее.

И знаешь что? Перерыв сработал.

Я отвлёкся, выдохнул, переключился на другие дела. А когда через пару дней вернулся к коду, меня осенило. Ошибка была не в коде. Она была в том, откуда я беру новости.

Если ты пропустил предыдущую часть, вот ссылка: Четвёртый день с DeepSeek: почти финиш, но я взял паузу. А сейчас — мой пятый день, день осознания и нового начала.

Утро пятого дня: отдохнувший мозг видит яснее

Я открыл чат с DeepSeek после перерыва и сказал: «Я понял. Плагин работает идеально на моём локальном сервере. Но на боевом хостинге он не может скачать RSS-ленту Technology Review. Я увеличивал таймауты, добавлял повторные попытки, кеширование — ничего не помогает».

DeepSeek спросил: «А что, если проблема не в технической части? Может быть, сайт просто не отдаёт полный контент?»

И тут меня осенило. Я зашёл на сайт Technology Review в обычном браузере и увидел это: замок. Статья требовала подписки. Полный текст был доступен только платным пользователям. RSS-лента отдавала только анонсы — те самые несколько предложений, которые я видел в постах.

Всё это время я бился головой о стену, пытаясь исправить то, что нельзя исправить кодом. Ошибка была не в плагине. Ошибка была в источнике данных.

Что я сделал за этот день

Даже несмотря на осознание, что Technology Review — платный, я продолжил улучшать плагин. Потому что другие источники будут работать. И я хочу, чтобы плагин был готов к любым условиям.

Окончательно починил сохранение настроек

Настройки теперь сохраняются идеально. Я переделал class-settings.php так, что все поля в одной форме, вкладки — просто навигация. Галки не слетают. Никогда.

Очистка контента — теперь идеальная

Я добавил комплексную очистку: удаляю **###---, обратные кавычки, множественные пробелы, пробелы перед знаками препинания. Контент стал кристально чистым.

php
private function clean_markdown( $text ) {
    $patterns = [
        '/\*\*/', '/__/', '/#{2,}/', '/-{2,}/', '/\*{2,}/', '/_{2,}/', '/\s{2,}/', '/```/'
    ];
    $text = preg_replace( $patterns, ' ', $text );
    return trim( preg_replace( '/\s+/', ' ', $text ) );
}

Ключевик — теперь главная сущность

Я добавил метод, который через GPT выделяет главную сущность: название продукта, имя человека, компанию. Больше никаких предлогов в ключевике.

Ключевик в первом абзаце — естественно

Теперь ключевик вставляется как часть предложения, выделяясь жирным, без лишних тире и двоеточий.

Убрал принудительный H2

Подзаголовки теперь генерируются GPT органично. Без штампов.

Объём контента — 600–800 слов

Увеличил max_tokens до 3000, добавил требование к объёму в промпт. Статьи стали полноценными.

Ссылка на источник — только домен

Вместо полного URL показываю technologyreview.com. Кратко и понятно.

Дубли исключены

Механизм запоминания ссылок работает надёжно. Каждая новость публикуется только один раз.

Изображения из RSS — с повторными попытками

Плагин ищет картинку в media:contentenclosure, или берёт первое img из контента. При ошибке — повторяет попытку.

Кеширование RSS для устойчивости

Я добавил кеширование RSS-ответа на 1 час через set_transient(). Если лента недоступна, плагин использует кеш.

Перевод контента на русский

Все промпты теперь содержат требование «на РУССКОМ языке». Контент стал полностью русскоязычным.

Главное открытие: ошибка была в источнике, не в коде

Когда я понял, что Technology Review — платный, я почувствовал облегчение. Потому что это означало, что мой плагин работает правильно. Он делал всё, что должен. Просто получал то, что ему отдавали.

DeepSeek сразу предложил альтернативные бесплатные RSS-источники. Вот некоторые из них:

DeepSeek рекомендовал начать с Google News — это бесплатно, стабильно и без подписки. Я так и сделал.

Что я понял за пять дней

  • Перерыв — это инструмент. Когда я отвлёкся, мозг продолжал работать в фоновом режиме и нашёл решение.

  • Ошибка может быть не в коде. Иногда проблема в окружении, в источнике данных, в бизнес-логике.

  • Не нужно гнаться за результатом. Этот путь — долгий. И он того стоит.

  • DeepSeek — не просто помощник. Он стал моим напарником, который не даёт опустить руки.

  • Плагин работает. И он будет работать ещё лучше с правильными источниками.

Плагин не работает идеально, но я на верном пути

Плагин «Autonews Publisher» сейчас полностью готов к работе. Он:

  • сохраняет настройки,

  • парсит RSS,

  • очищает контент,

  • генерирует статьи через YandexGPT,

  • добавляет SEO,

  • подгружает изображения,

  • исключает дубли.

Единственное, что осталось — выбрать правильные RSS-источники. И это уже не техническая проблема, а стратегическая.

Что дальше?

Я начну тестировать плагин с новыми источниками — Google News, The Verge, VentureBeat. Уверен, что результаты будут отличными.

А ещё я продолжу писать этот дневник. Потому что даже после финала плагина — это история о том, как человек учится, ошибается, отдыхает и идёт дальше.

Призыв к действию

Если ты тоже разрабатываешь что-то сложное — не забывай про отдых. Иногда лучший способ решить проблему — отойти от неё. Дать себе время. Посмотреть на неё свежим взглядом.

Подписывайся на мой блог, чтобы не пропустить следующую главу. Я почти у цели.

Контакты

📧 Email: milyutinkv@gmail.com
🌐 Сайт: milyutin-codes.ru
💬 Группа ВК: vk.ru/milyutin_codes

Задавай вопросы, делись идеями, пиши свои истории. Мы вместе.

Ключевая фраза

Ошибка была не в коде — она была в источнике.

Продолжение следует. Теперь — с новыми источниками.

Константин Милютин
Автор блога «Милютин Код»

Комментарии

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *