Пятый день с DeepSeek: перерыв помог — я нашёл ошибку, и она оказалась совсем не в коде

DeepSeek

Написано

в

Привет, друг!

Меня зовут Константин Пятый день с DeepSeek: перерыв помог — я нашёл ошибку, и она оказалась совсем не в коде. Если ты читаешь этот пост, значит, ты уже прошёл со мной путь от первой идеи до четвёртого дня, когда я взял паузу, чтобы не сойти с ума. Я честно признался, что устал, что упёрся в стену, и мне нужно время, чтобы осмыслить происходящее.

И знаешь что? Перерыв сработал.

Я отвлёкся, выдохнул, переключился на другие дела. А когда через пару дней вернулся к коду, меня осенило. Ошибка была не в коде. Она была в том, откуда мы берём новости.

Если ты пропустил предыдущую часть, вот ссылка: Четвёртый день с DeepSeek: почти финиш, но я взял паузу. А сейчас — наш пятый день, день осознания и нового начала.

Утро пятого дня: отдохнувший мозг видит яснее
Я открыл чат с DeepSeek после перерыва и сказал: «Я понял. Плагин работает идеально на моём локальном сервере. Но на боевом хостинге он не может скачать RSS-ленту Technology Review. Мы увеличивали таймауты, добавляли повторные попытки, кеширование — ничего не помогает».

DeepSeek спросил: «А что, если проблема не в технической части? Может быть, сайт просто не отдаёт полный контент?»

И тут меня осенило. Я зашёл на сайт Technology Review в обычном браузере и увидел это: замок. Статья требовала подписки. Полный текст был доступен только платным пользователям. RSS-лента отдавала только анонсы — те самые несколько предложений, которые мы видели в постах.

Всё это время мы бились головой о стену, пытаясь исправить то, что нельзя исправить кодом. Ошибка была не в плагине. Ошибка была в источнике данных.

Что мы сделали за этот день
Даже несмотря на осознание, что Technology Review — платный, мы продолжили улучшать плагин. Потому что другие источники будут работать. И мы хотим, чтобы плагин был готов к любым условиям.

  1. Окончательно починили сохранение настроек
    Настройки теперь сохраняются идеально. Мы переделали class-settings.php так, что все поля в одной форме, вкладки — просто навигация. Галки не слетают. Никогда.
  2. Очистка контента — теперь идеальная
    Мы добавили комплексную очистку: удаляем **, ###, —, обратные кавычки, множественные пробелы, пробелы перед знаками препинания. Контент стал кристально чистым.

php
private function clean_markdown( $text ) {
$patterns = [
‘/**/’, ‘/_/’, ‘/#{2,}/’, ‘/-{2,}/’, ‘/*{2,}/’, ‘/{2,}/’, ‘/\s{2,}/’, ‘/«`/’
];
$text = preg_replace( $patterns, ‘ ‘, $text );
return trim( preg_replace( ‘/\s+/’, ‘ ‘, $text ) );
}

  1. Ключевик — теперь главная сущность
    Мы добавили метод, который через GPT выделяет главную сущность: название продукта, имя человека, компанию. Больше никаких предлогов в ключевике.
  2. Ключевик в первом абзаце — естественно
    Теперь ключевик вставляется как часть предложения, выделяясь жирным, без лишних тире и двоеточий.
  3. Убрали принудительный H2
    Подзаголовки теперь генерируются GPT органично. Без штампов.
  4. Объём контента — 600–800 слов
    Увеличили max_tokens до 3000, добавили требование к объёму в промпт. Статьи стали полноценными.
  5. Ссылка на источник — только домен
    Вместо полного URL показываем technologyreview.com. Кратко и понятно.
  6. Дубли исключены
    Механизм запоминания ссылок работает надёжно. Каждая новость публикуется только один раз.
  7. Изображения из RSS — с повторными попытками
    Плагин ищет картинку в media:content, enclosure, или берёт первое img из контента. При ошибке — повторяет попытку.
  8. Кеширование RSS для устойчивости
    Мы добавили кеширование RSS-ответа на 1 час через set_transient(). Если лента недоступна, плагин использует кеш.
  9. Перевод контента на русский
    Все промпты теперь содержат требование «на РУССКОМ языке». Контент стал полностью русскоязычным.

Главное открытие: ошибка была в источнике, не в коде
Когда я понял, что Technology Review — платный, я почувствовал облегчение. Потому что это означало, что мой плагин работает правильно. Он делал всё, что должен. Просто получал то, что ему отдавали.

DeepSeek сразу предложил альтернативные бесплатные RSS-источники. Вот некоторые из них:

Источник RSS-ссылка
Google News (AI) https://news.google.com/rss/search?q=artificial+intelligence&hl=en-US&gl=US&ceid=US:en
The Verge (AI) https://www.theverge.com/rss/ai-artificial-intelligence/index.xml
VentureBeat (AI) https://venturebeat.com/category/ai/feed/
ArXiv (AI papers) https://arxiv.org/rss/cs.AI
DeepSeek рекомендовал начать с Google News — это бесплатно, стабильно и без подписки. Я так и сделал.

Что я понял за пять дней
Перерыв — это инструмент. Когда я отвлёкся, мозг продолжал работать в фоновом режиме и нашёл решение.

Ошибка может быть не в коде. Иногда проблема в окружении, в источнике данных, в бизнес-логике.

Не нужно гнаться за результатом. Этот путь — долгий. И он того стоит.

DeepSeek — не просто помощник. Он стал моим напарником, который не даёт опустить руки.

Плагин работает. И он будет работать ещё лучше с правильными источниками.

Плагин не работает идеально, но мы на верном пути
Плагин «Autonews Publisher» сейчас полностью готов к работе. Он:

сохраняет настройки,

парсит RSS,

очищает контент,

генерирует статьи через YandexGPT,

добавляет SEO,

подгружает изображения,

исключает дубли.

Единственное, что осталось — выбрать правильные RSS-источники. И это уже не техническая проблема, а стратегическая.

Что дальше?
Я начну тестировать плагин с новыми источниками — Google News, The Verge, VentureBeat. Уверен, что результаты будут отличными.

А ещё я продолжу писать этот дневник. Потому что даже после финала плагина — это история о том, как человек учится, ошибается, отдыхает и идёт дальше.

Призыв к действию
Друг, если ты тоже разрабатываешь что-то сложное — не забывай про отдых. Иногда лучший способ решить проблему — отойти от неё. Дать себе время. Посмотреть на неё свежим взглядом.

Подписывайся на мой блог, чтобы не пропустить следующую главу. Мы почти у цели.

Контакты
📧 Email: milyutinkv@gmail.com
🌐 Сайт: milyutin-codes.ru
💬 Группа ВК: vk.ru/milyutin_codes

Задавай вопросы, делись идеями, пиши свои истории. Мы вместе.

Ключевая фраза
Ошибка была не в коде — она была в источнике

Осознанность

Продолжение следует. Теперь — с новыми источниками.

Константин Милютин
Автор блога «Милютин Код»

Комментарии

Добавить комментарий

Ваш адрес email не будет опубликован. Обязательные поля помечены *