Нам часто приходится загружать различные файлы из интернета, например, исполняемые файлы программ, файлы скриптов, архивы с исходниками. Но не всегда это нужно делать через браузер. Во многих ситуациях гораздо проще выполнить все действия через терминал. Поскольку таким образом вы можете автоматизировать процесс. С другой стороны, веб-мастерам время от времени приходится тестировать доступность веб-сайтов, проверять отправляемые и получаемые заголовки и многое другое.
Для решения таких задач и задач подобного круга можно воспользоваться утилитой curl. Она позволяет решить намного более широкий круг задач, среди которых даже имитация действий пользователя на сайте. В этой статье мы рассмотрим как пользоваться curl, что это такое и зачем нужна эта программа.
Содержание статьи
Что такое curl?
На самом деле, curl - это больше чем просто утилита командной строки для Linux или Windows. Это набор библиотек, в которых реализуются базовые возможности работы с URL страницами и передачи файлов. Библиотека поддерживает работу с протоколами: FTP, FTPS, HTTP, HTTPS, TFTP, SCP, SFTP, Telnet, DICT, LDAP, а также POP3, IMAP и SMTP. Она отлично подходит для имитации действий пользователя на страницах и других операций с URL адресами.
Поддержка библиотеки curl была добавлена в множество различных языков программирования и платформ. Утилита curl - это независимая обвертка для этой библиотеки. Именно на этой утилите мы и остановимся в этой статье.
Команда curl
Перед тем как перейти к описанию того как может использоваться команда curl linux, давайте разберем саму утилиту и ее основные опции, которые нам понадобятся. Синтаксис утилиты очень прост:
$ curl опции ссылка
Теперь рассмотрим основные опции:
- -# - отображать простой прогресс-бар во время загрузки;
- -0 - использовать протокол http 1.0;
- -1 - использовать протокол шифрования tlsv1;
- -2 - использовать sslv2;
- -3 - использовать sslv3;
- -4 - использовать ipv4;
- -6 - использовать ipv6;
- -A - указать свой USER_AGENT;
- -b - сохранить Cookie в файл;
- -c - отправить Cookie на сервер из файла;
- -C - продолжить загрузку файла с места разрыва или указанного смещения;
- -m - максимальное время ожидания ответа от сервера;
- -d - отправить данные методом POST;
- -D - сохранить заголовки, возвращенные сервером в файл;
- -e - задать поле Referer-uri, указывает с какого сайта пришел пользователь;
- -E - использовать внешний сертификат SSL;
- -f - не выводить сообщения об ошибках;
- -F - отправить данные в виде формы;
- -G - если эта опция включена, то все данные, указанные в опции -d будут передаваться методом GET;
- -H - передать заголовки на сервер;
- -I - получать только HTTP заголовок, а все содержимое страницы игнорировать;
- -j - прочитать и отправить cookie из файла;
- -J - удалить заголовок из запроса;
- -L - принимать и обрабатывать перенаправления;
- -s - максимальное количество перенаправлений с помощью Location;
- -o - выводить контент страницы в файл;
- -O - сохранять контент в файл с именем страницы или файла на сервере;
- -p - использовать прокси;
- --proto - указать протокол, который нужно использовать;
- -R - сохранять время последнего изменения удаленного файла;
- -s - выводить минимум информации об ошибках;
- -S - выводить сообщения об ошибках;
- -T - загрузить файл на сервер;
- -v - максимально подробный вывод;
- -y - минимальная скорость загрузки;
- -Y - максимальная скорость загрузки;
- -z - скачать файл, только если он был модифицирован позже указанного времени;
- -V - вывести версию.
Это далеко не все параметры curl linux, но здесь перечислено все основное, что вам придется использовать.
Как пользоваться curl?
Мы рассмотрели все, что касается теории работы с утилитой curl, теперь пришло время перейти к практике, и рассмотреть примеры команды curl.
Загрузка файлов
Самая частая задача - это загрузка файлов linux. Скачать файл очень просто. Для этого достаточно передать утилите в параметрах имя файла или html страницы:
curl https://raw.githubusercontent.com/curl/curl/master/README.md
Но тут вас ждет одна неожиданность, все содержимое файла будет отправлено на стандартный вывод. Чтобы записать его в какой-либо файл используйте:
curl -o readme.txt https://raw.githubusercontent.com/curl/curl/master/README.md
А если вы хотите, чтобы полученный файл назывался так же, как и файл на сервере, используйте опцию -O:
curl -O https://raw.githubusercontent.com/curl/curl/master/README.md
Если загрузка была неожиданно прервана, вы можете ее возобновить:
curl -# -C - -O https://cdn.kernel.org/pub/linux/kernel/v4.x/testing/linux-4.11-rc7.tar.xz
Если нужно, одной командой можно скачать несколько файлов:
curl -O https://raw.githubusercontent.com/curl/curl/master/README.md -O https://raw.githubusercontent.com/curl/curl/master/README
Еще одна вещь, которая может быть полезной администратору - это загрузка файла, только если он был изменен:
curl -z 21-Dec-17 https://raw.githubusercontent.com/curl/curl/master/README.md -O https://raw.githubusercontent.com/curl/curl/master/README
Данная команда скачает файл, только если он был изменен после 21 декабря 2017.
Ограничение скорости
Вы можете ограничить скорость загрузки до необходимого предела, чтобы не перегружать сеть с помощью опции --limit-rate:
curl --limit-rate 50K -O https://cdn.kernel.org/pub/linux/kernel/v4.x/testing/linux-4.11-rc7.tar.xz
Здесь нужно указать количество килобайт в секунду, которые можно загружать. Также вы можете разорвать соединение если скорости недостаточно, для этого используйте опцию -Y:
curl -Y 100 -O https://raw.githubusercontent.com/curl/curl/master/README.md
Передача файлов
Загрузка файлов, это достаточно просто, но утилита позволяет выполнять и другие действия, например, отправку файлов на ftp сервер. Для этого существует опция -T:
curl -T login.txt ftp://speedtest.tele2.net/upload/
Или проверим отправку файла по HTTP, для этого существует специальный сервис:
curl -T ~/login.txt http://posttestserver.com/post.php
В ответе утилита сообщит где вы можете найти загруженный файл.
Отправка данных POST
Вы можете отправлять не только файлы, но и любые данные методом POST. Напомню, что этот метод используется для отправки данных различных форм. Для отправки такого запроса используйте опцию -d. Для тестирования будем пользоваться тем же сервисом:
curl -d "field1=val&fileld2=val1"http://posttestserver.com/post.php
Если вас не устраивает такой вариант отправки, вы можете сделать вид, что отправили форму. Для этого есть опция -F:
curl -F "password=@pass;type=text/plain" http://posttestserver.com/post.php
Здесь мы передаем формой поле password, с типом обычный текст, точно так же вы можете передать несколько параметров.
Передача и прием куки
Куки или Cookie используются сайтами для хранения некой информации на стороне пользователя. Это может быть необходимо, например, для аутентификации. Вы можете принимать и передавать Cookie с помощью curl. Чтобы сохранить полученные Cookie в файл используйте опцию -c:
curl -c cookie.txt http://posttestserver.com/post.php
Затем можно отправить cookie curl обратно:
curl -b cookie.txt http://posttestserver.com/post.php
Передача и анализ заголовков
Не всегда нам обязательно нужно содержимое страницы. Иногда могут быть интересны только заголовки. Чтобы вывести только их есть опция -I:
curl -I https://losst.pro
А опция -H позволяет отправить нужный заголовок или несколько на сервер, например, можно передать заголовок If-Modified-Since чтобы страница возвращалась только если она была изменена:
curl -I --header 'If-Modified-Since: Mon, 26 Dec 2016 18:13:12 GMT' https://losst.pro
Аутентификация curl
Если на сервере требуется аутентификация одного из распространенных типов, например, HTTP Basic или FTP, то curl очень просто может справиться с такой задачей. Для указания данных аутентификации просто укажите их через двоеточие в опции -u:
curl -u ftpuser:ftppass -T - ftp://ftp.testserver.com/myfile_1.txt
Точно так же будет выполняться аутентификация на серверах HTTP.
Использование прокси
Если вам нужно использовать прокси сервер для загрузки файлов, то это тоже очень просто. Достаточно задать адрес прокси сервера в опции -x:
curl -x proxysever.test.com:3128 http://google.co.in
Выводы
В этой статье мы рассмотрели как пользоваться curl, зачем нужна эта утилита и основные ее возможности. Несмотря на свою схожесть с wget, они очень сильно отличаются. Команда curl linux предназначена больше для анализа и имитации различных действий на сервере, тогда как wget больше подходит для загрузки файлов и краулинга сайтов.
Спасибо
Кстати, по кукам вы перепутали -b и -c
Подскажите пожалуйста, пытаясь настроить open cart, локальный сервер не видит curl, устанавливал его точно так же как и другие дополнения, все находятся, а curl нет. Я не могу точно описать проблему, т.к не пойму как определить ее, помогите понять где начать копать.
2ВИТАЛИК
брат зачем тебе линукс брат
96% времени тебя будут одолевать такие вопросы
Как ждать ответа от сайта, пока не ответит? --expect100-timeout почему-то не работает или не правильно пишу.
POST TEST SERVER переехал, поправьте статью
Я загрузил последний zip файл cURL из веб-сайта, вер. 7.24.0. Теперь, как это установить в моей среде Windows, чтобы иметь возможность использовать его? Мне не нужно создавать cURL из источника, чтобы использовать его.
Нужно ли его компилировать?
Если да, то как это сделать?
Я искал любую документацию по установке, но это указывает на установку cURL в качестве проекта из источника.
Превосходная статья!! Всё чётко, разобрано до мелочей, с нормальным форматированием текста и скринами! Буду рекомендовать студентам Ваш сайт к прочтению. Где кнопка Donate??
ще б batch файл з виводом протокола у файл
Хорошо написано, спасибо.
В статье куча ошибок, например
вместо -s нужно --max-redirs
вместо -y нужно --limit-rate
и тд.
А еще лучше установить Postman и не париться 😉
Да, давайте поотправляем на posttestserver.com/post.php , который блокируется каспером по причине HEUR:Trojan.Multi.Preqw.gen