Я работаю с DeepSeek. Если ты читаешь этот пост, значит, ты уже прошёл со мной путь от первой идеи до четвёртого дня, когда я взял паузу, чтобы не сойти с ума. Я честно признался, что устал, что упёрся в стену, и мне нужно время, чтобы осмыслить происходящее.
И знаешь что? Перерыв сработал.
Я отвлёкся, выдохнул, переключился на другие дела. А когда через пару дней вернулся к коду, меня осенило. Ошибка была не в коде. Она была в том, откуда я беру новости.
Если ты пропустил предыдущую часть, вот ссылка: Четвёртый день с DeepSeek: почти финиш, но я взял паузу. А сейчас — мой пятый день, день осознания и нового начала.
Утро пятого дня: отдохнувший мозг видит яснее
Я открыл чат с DeepSeek после перерыва и сказал: «Я понял. Плагин работает идеально на моём локальном сервере. Но на боевом хостинге он не может скачать RSS-ленту Technology Review. Я увеличивал таймауты, добавлял повторные попытки, кеширование — ничего не помогает».
DeepSeek спросил: «А что, если проблема не в технической части? Может быть, сайт просто не отдаёт полный контент?»
И тут меня осенило. Я зашёл на сайт Technology Review в обычном браузере и увидел это: замок. Статья требовала подписки. Полный текст был доступен только платным пользователям. RSS-лента отдавала только анонсы — те самые несколько предложений, которые я видел в постах.
Всё это время я бился головой о стену, пытаясь исправить то, что нельзя исправить кодом. Ошибка была не в плагине. Ошибка была в источнике данных.
Что я сделал за этот день
Даже несмотря на осознание, что Technology Review — платный, я продолжил улучшать плагин. Потому что другие источники будут работать. И я хочу, чтобы плагин был готов к любым условиям.
Окончательно починил сохранение настроек
Настройки теперь сохраняются идеально. Я переделал class-settings.php так, что все поля в одной форме, вкладки — просто навигация. Галки не слетают. Никогда.
Очистка контента — теперь идеальная
Я добавил комплексную очистку: удаляю **, ###, ---, обратные кавычки, множественные пробелы, пробелы перед знаками препинания. Контент стал кристально чистым.
private function clean_markdown( $text ) { $patterns = [ '/\*\*/', '/__/', '/#{2,}/', '/-{2,}/', '/\*{2,}/', '/_{2,}/', '/\s{2,}/', '/```/' ]; $text = preg_replace( $patterns, ' ', $text ); return trim( preg_replace( '/\s+/', ' ', $text ) ); }
Ключевик — теперь главная сущность
Я добавил метод, который через GPT выделяет главную сущность: название продукта, имя человека, компанию. Больше никаких предлогов в ключевике.
Ключевик в первом абзаце — естественно
Теперь ключевик вставляется как часть предложения, выделяясь жирным, без лишних тире и двоеточий.
Убрал принудительный H2
Подзаголовки теперь генерируются GPT органично. Без штампов.
Объём контента — 600–800 слов
Увеличил max_tokens до 3000, добавил требование к объёму в промпт. Статьи стали полноценными.
Ссылка на источник — только домен
Вместо полного URL показываю technologyreview.com. Кратко и понятно.
Дубли исключены
Механизм запоминания ссылок работает надёжно. Каждая новость публикуется только один раз.
Изображения из RSS — с повторными попытками
Плагин ищет картинку в media:content, enclosure, или берёт первое img из контента. При ошибке — повторяет попытку.
Кеширование RSS для устойчивости
Я добавил кеширование RSS-ответа на 1 час через set_transient(). Если лента недоступна, плагин использует кеш.
Перевод контента на русский
Все промпты теперь содержат требование «на РУССКОМ языке». Контент стал полностью русскоязычным.
Главное открытие: ошибка была в источнике, не в коде
Когда я понял, что Technology Review — платный, я почувствовал облегчение. Потому что это означало, что мой плагин работает правильно. Он делал всё, что должен. Просто получал то, что ему отдавали.
DeepSeek сразу предложил альтернативные бесплатные RSS-источники. Вот некоторые из них:
DeepSeek рекомендовал начать с Google News — это бесплатно, стабильно и без подписки. Я так и сделал.
Что я понял за пять дней
-
Перерыв — это инструмент. Когда я отвлёкся, мозг продолжал работать в фоновом режиме и нашёл решение.
-
Ошибка может быть не в коде. Иногда проблема в окружении, в источнике данных, в бизнес-логике.
-
Не нужно гнаться за результатом. Этот путь — долгий. И он того стоит.
-
DeepSeek — не просто помощник. Он стал моим напарником, который не даёт опустить руки.
-
Плагин работает. И он будет работать ещё лучше с правильными источниками.
Плагин не работает идеально, но я на верном пути
Плагин «Autonews Publisher» сейчас полностью готов к работе. Он:
-
сохраняет настройки,
-
парсит RSS,
-
очищает контент,
-
генерирует статьи через YandexGPT,
-
добавляет SEO,
-
подгружает изображения,
-
исключает дубли.
Единственное, что осталось — выбрать правильные RSS-источники. И это уже не техническая проблема, а стратегическая.
Что дальше?
Я начну тестировать плагин с новыми источниками — Google News, The Verge, VentureBeat. Уверен, что результаты будут отличными.
А ещё я продолжу писать этот дневник. Потому что даже после финала плагина — это история о том, как человек учится, ошибается, отдыхает и идёт дальше.
Призыв к действию
Если ты тоже разрабатываешь что-то сложное — не забывай про отдых. Иногда лучший способ решить проблему — отойти от неё. Дать себе время. Посмотреть на неё свежим взглядом.
Подписывайся на мой блог, чтобы не пропустить следующую главу. Я почти у цели.
Контакты
📧 Email: milyutinkv@gmail.com
🌐 Сайт: milyutin-codes.ru
💬 Группа ВК: vk.ru/milyutin_codes
Задавай вопросы, делись идеями, пиши свои истории. Мы вместе.
Ключевая фраза
Ошибка была не в коде — она была в источнике.
Продолжение следует. Теперь — с новыми источниками.
Константин Милютин
Автор блога «Милютин Код»

Добавить комментарий