Прескочи към основното съдържание Прескочи към навигацията

Към този урок няма файлове за сваляне

Допълнения към урока

Пълен достъп до курса: Не

За пълен достъп, моля влезте или се регистрирайте.


Най-важното за извличане на съдържание от уеб страница

HTTP заявките са основата на комуникацията между n8n, уебсайтове и API-та. Когато готов node не дава нужната функционалност, HTTP Request позволява сами да дефинирате какво точно да поискаме или изпратим. За новинарска статия целта е да вземем суровия HTML, който после ще бъде подготвен за AI обработка.

Как да повториш показаното

  1. Добави HTTP Request node след стъпката, в която вече имаш Publisher URL.
  2. Избери метод GET, защото искаш да получиш съдържанието на страницата.
  3. Постави Publisher URL в полето за URL.
  4. Остави Authentication изключена, ако страницата е публична.
  5. Не добавяй Query Parameters, ако URL адресът не ги изисква.
  6. По желание добави header User-Agent със стойност като Mozilla/5.0, като спазваш главни и малки букви.
  7. В опциите активирай следване на пренасочвания и включи Response Headers и Response Code.
  8. Задай response формат като текст и го именувай HTML.
  9. Стартирай node-а и провери за статус 200 OK.

Ключови настройки и термини

  • GET - получава данни от сървър или API.
  • POST - изпраща данни и често създава нов ресурс.
  • PATCH - прави частична промяна на съществуващ ресурс.
  • DELETE - изтрива ресурс.
  • User-Agent - header, който идентифицира клиента, изпращащ заявката.

Дискусия към урока