Sed регулярные выражения примеры. Sed — Ай да Linux Wiki. Выбор нужных элементов редактируемого текста

И я не могу найти хорошо написанные учебники.

Позвольте мне сказать, что я работал с регулярным выражением на других языках (Python, JavaScript, Java), поэтому это не должно быть проблемой.

Итак, вот мои вопросы («теоретические» и более практичные):

    регулярные выражения, используемые в sed точно такие же, как те, которые используются Python / JS / Java? Я читал о BRE и EREs, но насколько они различны? Не должно ли ERE быть расширением BRE?

    если я хочу, скажем, просто извлечь что-то из выходного канала, что такое синтаксис sed ?

Подробности по второму вопросу: скажем, у меня есть выход uptime с sed:

Uptime | sed ...

Учитывая пример выхода от uptime: 18:13 up 5:12, 2 users, load averages: 0,45 0,37 0,40 , я хочу разобрать единовременное время работы в виде двух разделенных номеров (часы и минуты) , а затем я хочу отобразить их в виде xxhyym (xx – часы, yy минуты).

И чтобы закончить, вот что я сделал бы на Python:

Hh, mm = re.match(r"\s+ up \s+(\d{1,2}):(\d{1,2})").groups() print "%sh%sm" % (hh, mm)

2 Solutions collect form web for “Регулярные команды и команды с командой sed”

Традиционные инструменты unix поддерживают BRE или ERE (базовые или расширенные регулярные выражения). POSIX кодирует оба. Википедия объясняет их. Большинство современных инструментов расширяют ERE, часто с дополнительными функциями, впервые представленными в Perl (который известен как PCRE).

ERE расширяет функциональность BRE, но не расширяет синтаксис. В BRE только символы \[.*^$ Имеют особое значение, а некоторые операторы, такие как группировка \(…\) используют обратную косую черту. В ERE +?|() Также являются специальными, а обратная косая черта, сопровождаемая не-буквенно-цифровым символом, никогда не бывает особенной.

BRE не имеет Python / PCRE \d и \s . Вы можете выразить эти наборы символов с помощью традиционных наборов конструкций и классов символов: \d is [[:digit:]] и \s is [[:space:]] . Обратите внимание на двойные скобки: один для указания набора символов и один для обозначения класса символов; например, «буквы, тире или символы подчеркивания» можно записать [-_[:alpha:]] .

У BRE нет оператора + (некоторые реализации sed поддерживают \+ как расширение синтаксиса BRE); X+ совпадает с XX* . Для групп и совпадений требуется дополнительная обратная косая черта.

Таким образом, BRE эквивалент Python \s+ up \s+(\d{1,2}):(\d{1,2}) является [[:space:]][[:space:]]* up [[:space:]][[:space:]]*\([[:digit:]]\{1,2\}\):\([[:digit:]]\{1,2\}\) . Обратите внимание, что вы слишком много пробегаете: \s+ и пробел означает как минимум два пробельных символа.

Вам нужно будет сопоставить всю строку, так как команда sed переписывает строку. Не существует отдельной команды для записи строки, собранной из сохраненных групп. Исправляя лишние пробелы, аналог вашего фрагмента Python:

Uptime | sed "s/^.*[[:space:]][[:space:]]*up[[:space:]][[:space:]]*\([[:digit:]]\{1,2\}\):\([[:digit:]]\{1,2\}\).*$/\1h\2m/"

В отличие от фрагмента Python, это извлекает первый матч, а не последний матч, но здесь это не имеет значения.

Вывод uptime содержит символы пробела и цифры ASCII, поэтому вы можете упростить регулярное выражение:

Uptime | sed "s/^.* up *\(\{1,2\}\):\(\{1,2\}\).*$/\1h\2m/"

Это будет соответствовать только выходному uptime если машина была меньше 1 дня. Я оставлю соответствующее количество дней в качестве упражнения. (Подсказка: напишите два выражения: sed -es/AS ABOVE/\1h\2m/ -e "s/EXERCISE/\1d\2h\3m/")

Каждый инструмент использует (в основном) собственную библиотеку RE. Даже среди разных версий sed вы найдете здесь различия. Два популярных стандарта – стандартные регулярные выражения POSIX, многие из которых принимают их (по крайней мере, с некоторыми опциями), другой популярный набор – это библиотека регулярного выражения Perl Compatible Regular Expression (PCRE). Но последние немного отличаются от «ванильных» RE …

В твоем случае:

Uptime | sed -e "s/^ \(\):\(\).*$/\1h\2m/"

(Пробовали на Fedora 18, sed-4.2.1-10.fc18.x86_64, GNU sed).

Обновление: что не так с большой документацией на главной странице GNU sed ? Или этот учебник? Информационная документация для GNU sed немного длинная, но полная.


Автор: Rares Aioanei
Дата публикации: 19 ноября 2011 года
Перевод: А. Кривошей
Дата перевода: июль 2012 г.

1. Введение

Добро пожаловать во вторую часть нашей серии, которая посвящена sed, версии GNU. Существует несколько версий sed, которые доступны на разных платформах, но мы сфокусируемся на GNU sed версии 4.x. Многие из вас слышали о sed, или уже использовали его, скорее всего в качестве инструмента замены. Но это только одно из предназначений sed, и мы постараемся показать вам все аспекты использования этой утилиты. Его название расшифровывается как "Stream EDitor" и слово "stream" (поток) в данном случае может означать файл, канал, или просто stdin. Мы надеемся, что у вас уже есть базовые знания о Linux, а если вы уже работали с регулярными выражениями, или по крайней мере знаете, что это такое, то все для вас будет намного проще. Объем статьи не позволяет включить в нее полное руководство по регулярным выражениям, вместо этого мы озвучим базовые концепции и дадим большое количество примеров использования sed.

2. Установка

Здесь не нужно много рассказывать. Скорее все sed у вас уже установлен, так как он используется различными системными скриптами, а также пользователями Linux, которые хотят повысить эффективность своей работы. Вы можете узнать, какая версия sed у вас установлена, с помощью команды:

$ sed --version

В моей системе эта команда показывает, что у меня установлен GNU sed 4.2.1 плюс дает ссылку на домашнюю страницу программы и другие полезные сведения. Пакет называется "sed" независимо от дистрибутива, кроме Gentoo, где он присутствует неявно.

3. Концепции

Перед тем, как идти дальше, мы считаем важным акцентировать внимание на том, что делает "sed", так как словосочетание "потоковый редактор" мало что говорит о его назначении. sed принимает на входе текст, выполняет заданные операции над каждой строкой (если не задано другое) и выводит модифицированный текст. Указанными операциями могут быть добавление, вставка, удаление или замена. Это не так просто, как выглядит: предупреждаю, что имеется большое количество опций и их комбинаций, которые могут сделать команду sed очень трудной для понимания. Поэтому мы рекомендуем вам изучить основы регулярных выражений, чтобы понимать, как это работает. Перед тем, как приступить к руководству, мы хотели бы поблагодарить Eric Pement и других за вдохновление и за то, что он сделал для всех, кто хочет изучать и использовать sed.

4. Регулярные выражения

Так как команды (скрипты) sed для многих остаются загадкой, мы чувствуем, что наши читатели должны понимать базовые концепции, а не слепо копировать и вставлять команды, значения которых они не понимают. Когда человек хочет понять, что представляют собой регулярные выражения, ключевым словом является "соответствие", или, точнее, "шаблон соответствия". Например, в отчете для своего департамента вы написали имя Nick, обращаясь к сетевому архитектору. Но Nick ушел, а на его место пришел John, поэтому теперь вы должны заменить слово Nick на John. Если файл с отчетом называется report.txt, вы должны выполнить следующую команду:

$ cat report.txt / sed "s/Nick/John/g" > report_new.txt

По умолчанию sed использует stdout, вы можете использовать оператор перенаправления вывода, как показано в примере выше. Это очень простой пример, но мы проиллюстрировали несколько моментов: мы ищем все соответствия шаблону "Nick" и заменяем во всех случаях на "John". Отметим, что sed призводит поиск с учетом регистра, поэтому будьте внимательны и проверьте выходной файл, чтобы убедиться, что все замены были выполнены. Приведенный выше пример можно было записать и так:

$ sed "s/Nick/John/g" report.txt > report_new.txt

Хорошо, скажете вы, но где же здесь регулярные выражения? Да, мы хотели сначала показать пример, а теперь начинается самая интересная часть.
Если вы не уверены, написали ли вы "nick" или "Nick", и хотите предусмотреть оба случая, необходимо использовать команду sed "s/Nick/nick/John/g". Вертикальная черта имеет значение, которое вы должны знать, если изучали C, то есть ваше выражение будет соответствовать "nick" или "Nick". Как вы увидите ниже, канал может использоваться и другими способами, но смысл остается тот же самый. Другие операторы, широко использующиеся в регулярных выражениях - это "?", который соответствует повторению предшествующего символа ноль или один раз (то есть flavou?r будет соответствовать flavor и flavour), "*" - ноль или более раз, "+" - один или более раз. "^" соответствует началу строки, а "$" - наоборот. Если вы - пользователь vi или vim, многие вещи покажутся вам знакомыми. В конце концов, эти утилиты, вместе с awk и С уходят корнями в ранние дни UNIX. Мы не будем больше говорить на эту тему, так как проще понять значение этих символов на примерах, но вы должны знать, что существуют различные реализации регулярных выражений: POSIX, POSIX Extended, Perl, а также различные реализации нечетких регулярных выражений, гарантирующие вам головную боль.

5. Примеры использования sed

Синтаксис команды Описание
sed "s/Nick/John/g" report.txt Заменяет каждое вхождение Nick на John в файле report.txt
sed "s/Nick/nick/John/g" report.txt Заменяет каждое вхождение Nick или nick на John.
sed "s/^/ /" file.txt >file_new.txt Добавляет 8 пробелов слева от текста для улучшения качества печати.
sed -n "/Of course/,/attention you \
pay/p" myfile
Выводит один абзац, начинающийся с "Of course" и заканчивающийся на "attention you pay"
sed -n 12,18p file.txt Выводит только строки 12-18 файла file.txt
sed 12,18d file.txt Выводит весь файл file.txt за исключением строк с 12 по 18
sed G file.txt Удваивает пробелы в file.txt
sed -f script.sed file.txt Записывает все команды в script.sed и выполняет их.
sed "5!s/ham/cheese/" file.txt Заменяет ham на cheese в file.txt за исключением 5-й строки
sed "$d" file.txt Удаляет последнюю строку
sed "/\{3\}/p" file.txt Печатает только строки с тремя последовательными цифрами
sed "/boom/!s/aaa/bb/" file.txt Если найден "boom", заменить aaa на bb
sed "17,/disk/d" file.txt Удаляет все строки, начиная с 17-й, до "disk"
echo ONE TWO / sed "s/one/unos/I" Заменяет one на unos независимо от регистра, поэтому будет напечатано "unos TWO"
sed "G;G" file.txt Утраивает пробелы в файле
sed "s/.$//" file.txt Способ замены dos2unix:)
sed "s/^[ ^t]*//" file.txt Удаляет все пробелы перед каждой строкой в file.txt
sed "s/[ ^t]*$//" file.txt Удаляет все пробелы в конце каждой строки в file.txt
sed "s/^[ ^t]*//;s/[ ^]*$//" file.txt Удаляет все пробелы в начале и в конце каждой строки в file.txt
sed "s/foo/bar/" file.txt Заменяет foo на bar только в первом вхождении в строке.
sed "s/foo/bar/4" file.txt Заменяет foo на bar только в четвертом вхождении в строке.
sed "s/foo/bar/g" file.txt Заменяет foo на bar для всех вхождений в строке.
sed "/baz/s/foo/bar/g" file.txt Заменить foo на bar только если строка содержит baz.
sed "/./,/^$/!d" file.txt Удалить все последовательные пустые строки за исключением EOF
sed "/^$/N;/\n$/D" file.txt Удалить все последовательные пустые строки, но оставить верхнюю пустую строку.
sed "/./,$!d" file.txt Удалить все начальные пустые строки
sed -e:a -e "/^\n*$/{$d;N;};/\n$/ba" \
file.txt
Удалить все замыкающие пустые строки
sed -e:a -e "/\\$/N; s/\\\n//; ta" \
file.txt
Если файл заканчивается обратным сплешем, соединить его со следующим (полезно для скриптов оболочки)
sed "/regex/,+5/expr/" Соответствует regex плюс 5 следующих строк
sed "1~3d" file.txt Удалить каждую третью строку, начиная с первой.
sed -n "2~5p" file.txt Печатать каждую пятую строку, начиная со второй.
sed "s/ick/John/g" report.txt Другой способ записи некоторых приведенных выше примеров. Вы можете предложить свой?
sed -n "/RE/{p;q;}" file.txt Печатает только первое соответствие RE (регулярного выражения)
sed "0,/RE/{//d;}" file.txt Удаляет только первое соответствие
sed "0,/RE/s//to_that/" file.txt Изменяет только первое соответствие
sed "s/^[^,]*,/9999,/" file.csv Заменяет первое поле на 9999 в CSV-файле
s/^ *\(.*[^ ]\) *$//\1//; s/" *, */"//g; : loop s// *\([^",/][^,/]*\) *, *//\1//g; s// *, *//\1//g; t loop s/ *////g; s// *///g; s/^/\(.*\)/$/\1/; Скрипт sed для конвертирования CSV-файла в файл с вертикальной чертой в качестве разделителя (работает только с некоторыми типами CSV, со встроенными кавычками и запятыми).
sed ":a;s/\(^\/[^0-9.]\)\(\+\)\(\{3\}\)/\1\2,\3/g;ta" file.txt Меняет формат чисел в file.txt с 1234.56 на 1.234.56
sed -r "s/\<(reg/exp)+/\U&/g" Переводит любое слово, начинающееся с reg или exp в верхний регистр.
sed "1,20 s/Johnson/White/g" file.txt Производит замену Johnson на White только в строках 1 - 20.
sed "1,20 !s/Johnson/White/g" file.txt Предыдущий пример наоборот (заменяет везде, кроме строк 1-20)
sed "/from/,/until/ { s/\ /magenta/g; \ s/\ /cyan/g; }" file.txt Заменяет только между "from" и "until"
sed "/ENDNOTES:/,$ { s/Schaff/Herzog/g; \ s/Kraft/Ebbing/g; }" file.txt Заменяет только со слова "ENDNOTES:" и до EOF
sed "/./{H;$!d;};x;/regex/!d" file.txt Печатает абзац только если он содержит regex
sed -e "/./{H;$!d;}" -e "x;/RE1/!d;/RE2/!d;/RE3/!d" file.txt Печатает абзацы только если они содержат RE1, RE2 и RE3
sed "s/14"/fourteen inches/g" file.txt Так вы сможете использовать двойные кавычки
sed "s/\/some\/UNIX\/path/\/a\/new\/path/g" file.txt Работа с путями Unix
sed "s///g" file.txt Удаляет все символы, начиная с a и заканчивая g из файла file.txt
sed "s/\(.*\)foo/\1bar/" file.txt Заменяет только последнее соответствие foo на bar
sed "1!G;h;$!d" Замена команды tac
sed "/\n/!G;s/\(.\)\(.*\n\)/&\2\1/;//D;s/.//" Замена команды rev
sed 10q file.txt Замена команды head
sed -e:a -e "$q;N;11,$D;ba" \ file.txt Замена команды tail
sed "$!N; /^\(.*\)\n\1$/!P; D" \ file.txt Замена команды uniq
sed "$!N; s/^\(.*\)\n\1$/\1/;\ t; D" file.txt Обратная команда (что эквивалентно uniq -d)
sed "$!N;$!D" file.txt Эквивалент tail -n 2
sed -n "$p" file.txt ... tail -n 1 (или tail -1)
sed "/regexp/!d" file.txt Эквивалент grep
sed -n "/regexp/{g;1!p;};h" file.txt Печатает строку, находящуюся перед первым соответствием регулярному выражению, но не включающую само соответствие
sed -n "/regexp/{n;p;}" file.txt Печатает строку, находящуюся после первого соответствия регулярному выражению, но не включающую само соответствие
sed "/pattern/d" file.txt Удаляет строки, соответствующие шаблону pattern
sed "/./!d" file.txt Удаляет все пустые строки из файла
sed "/^$/N;/\n$/N;//D" file.txt Удаляет все следующие друг за другом пустые строки, за исключением первых двух
sed -n "/^$/{p;h;};/./{x;/./p;}"\ file.txt Удаляет последнюю строку каждого абзаца
sed "/^$/q" Получает заголовок письма
sed "1,/^$/d" Получает тело письма
sed "/^Subject: */!d; s///;q" Получает тему письма
sed "s/^/> /" Цитирует сообщение, вставляя "> " перед каждой строкой
sed "s/^> //" Обратная команда (убирает цитирование из сообщения)
sed -e:a -e "s/<[^>]*>//g;/ Удаляет HTML-теги
sed "/./{H;d;};x;s/\n/={NL}=/g" file.txt / sort \ / sed "1s/={NL}=//;s/={NL}=/\n/g" Сортирует абзацы в file.txt в алфавитном порядке
sed "s@/usr/bin@&/local@g" path.txt Заменяет /usr/bin на /usr/bin/local в path.txt
sed "s@^.*$@<<<&>>>@g" path.txt Попробуйте и увидите:)
sed "s/\(\/[^:]*\).*/\1/g" path.txt При условии, что path.txt содержит $PATH, выводит только первый путь в каждой строке
sed "s/\([^:]*\).*/\1/" /etc/passwd Замена awk - показывает только пользователей из файла passwd
echo "Welcome To The Geek Stuff" / sed \ "s/\(\b\)/\(\1\)/g" (W)elcome (T)o (T)he (G)eek (S)tuff Понятно без объяснений
sed -e "/^$/,/^END/s/hills/\ mountains/g" file.txt Заменяет "hills" на "mountains", но только в блоках текста, начинающихся с пустой строки и заканчивающихся строкой с тремя символами "END", включительно.
sed -e "/^#/d" /etc/services / more Показывает файл services без закомментированных строк
sed "$s@\([^:]*\):\([^:]*\):\([^:]*\)@\3:\2:\1@g" path.txt Меняет порядок элементов в последней строке файла path.txt на обратный
sed "/regex/{x;p;x;}" file.txt Вставляет новую строку выше каждой строки, соответствующей регулярному выражению
sed "/AAA/!d; /BBB/!d; /CCC/!d" file.txt Ищет соответствие AAA, BBB и CCC в любом порядке
sed "/AAA.*BBB.*CCC/!d" file.txt Ищет соответствие AAA, BBB и CCC в заданном порядке
sed -n "/^.\{65\}/p" file.txt Печатает строки длиной 65 символов и более
sed -n "/^.\{65\}/!p" file.txt Печатает строки длиной 65 символов и менее
sed "/regex/G" file.txt Вставляет пустую строку под каждой строкой
sed "/regex/{x;p;x;G;}" file.txt Вставляет пустую строку над и под каждой строкой
sed = file.txt / sed "N;s/\n/\t/" Нумерует строки в file.txt
sed -e:a -e "s/^.\{1,78\}$/ &/;ta" file.txt Выровнять текст по правому краю
sed -e:a -e "s/^.\{1,77\}$/ &/;ta" -e "s/\(*\)\1/\1/" file.txt Выровнять текст по центру

6. Заключение

Это только часть того, что можно бы было рассказать о sed, но данная серия статей представляет собой скорее практическое руководство, которое, как мы надеемся, поможет вам оценить всю мощь утилит Unix и сделает вашу работу более эффективной.


Автор: Rares Aioanei
Дата публикации: 19 ноября 2011 года
Перевод: А. Кривошей
Дата перевода: июль 2012 г.

Николай Игнатушко проверил на GNU sed version 4.2.1 в дистрибутиве Gentoo все команды, упомянутые в этой статье. Не все скрипты хорошо отрабатывали на версии GNU sed. Но дело касалось мелочей, которые исправлены. Только скрипт по замене hill на mountains пришлось существенно переделать.

1. Введение

Добро пожаловать во вторую часть нашей серии, которая посвящена sed, версии GNU. Существует несколько версий sed, которые доступны на разных платформах, но мы сфокусируемся на GNU sed версии 4.x. Многие из вас слышали о sed, или уже использовали его, скорее всего в качестве инструмента замены. Но это только одно из предназначений sed, и мы постараемся показать вам все аспекты использования этой утилиты. Его название расшифровывается как "Stream EDitor" и слово "stream" (поток) в данном случае может означать файл, канал, или просто stdin. Мы надеемся, что у вас уже есть базовые знания о Linux, а если вы уже работали с регулярными выражениями, или по крайней мере знаете, что это такое, то все для вас будет намного проще. Объем статьи не позволяет включить в нее полное руководство по регулярным выражениям, вместо этого мы озвучим базовые концепции и дадим большое количество примеров использования sed.

2. Установка

Здесь не нужно много рассказывать. Скорее все sed у вас уже установлен, так как он используется различными системными скриптами, а также пользователями Linux, которые хотят повысить эффективность своей работы. Вы можете узнать, какая версия sed у вас установлена, с помощью команды:

$ sed --version

В моей системе эта команда показывает, что у меня установлен GNU sed 4.2.1 плюс дает ссылку на домашнюю страницу программы и другие полезные сведения. Пакет называется "sed" независимо от дистрибутива, кроме Gentoo, где он присутствует неявно.

3. Концепции

Перед тем, как идти дальше, мы считаем важным акцентировать внимание на том, что делает "sed", так как словосочетание "потоковый редактор" мало что говорит о его назначении. sed принимает на входе текст, выполняет заданные операции над каждой строкой (если не задано другое) и выводит модифицированный текст. Указанными операциями могут быть добавление, вставка, удаление или замена. Это не так просто, как выглядит: предупреждаю, что имеется большое количество опций и их комбинаций, которые могут сделать команду sed очень трудной для понимания. Поэтому мы рекомендуем вам изучить основы регулярных выражений, чтобы понимать, как это работает. Перед тем, как приступить к руководству, мы хотели бы поблагодарить Eric Pement и других за вдохновление и за то, что он сделал для всех, кто хочет изучать и использовать sed.

4. Регулярные выражения

Так как команды (скрипты) sed для многих остаются загадкой, мы чувствуем, что наши читатели должны понимать базовые концепции, а не слепо копировать и вставлять команды, значения которых они не понимают. Когда человек хочет понять, что представляют собой регулярные выражения, ключевым словом является "соответствие", или, точнее, "шаблон соответствия". Например, в отчете для своего департамента вы написали имя Nick, обращаясь к сетевому архитектору. Но Nick ушел, а на его место пришел John, поэтому теперь вы должны заменить слово Nick на John. Если файл с отчетом называется report.txt, вы должны выполнить следующую команду:

$ cat report.txt | sed "s/Nick/John/g" > report_new.txt

По умолчанию sed использует stdout, вы можете использовать оператор перенаправления вывода, как показано в примере выше. Это очень простой пример, но мы проиллюстрировали несколько моментов: мы ищем все соответствия шаблону "Nick" и заменяем во всех случаях на "John". Отметим, что sed призводит поиск с учетом регистра, поэтому будьте внимательны и проверьте выходной файл, чтобы убедиться, что все замены были выполнены. Приведенный выше пример можно было записать и так:

$ sed "s/Nick/John/g" report.txt > report_new.txt

Хорошо, скажете вы, но где же здесь регулярные выражения? Да, мы хотели сначала показать пример, а теперь начинается самая интересная часть.
Если вы не уверены, написали ли вы "nick" или "Nick", и хотите предусмотреть оба случая, необходимо использовать команду sed "s/Nick|nick/John/g". Вертикальная черта имеет значение, которое вы должны знать, если изучали C, то есть ваше выражение будет соответствовать "nick" или "Nick". Как вы увидите ниже, канал может использоваться и другими способами, но смысл остается тот же самый. Другие операторы, широко использующиеся в регулярных выражениях - это "?", который соответствует повторению предшествующего символа ноль или один раз (то есть flavou?r будет соответствовать flavor и flavour), "*" - ноль или более раз, "+" - один или более раз. "^" соответствует началу строки, а "$" - наоборот. Если вы - пользователь vi или vim, многие вещи покажутся вам знакомыми. В конце концов, эти утилиты, вместе с awk и С уходят корнями в ранние дни UNIX. Мы не будем больше говорить на эту тему, так как проще понять значение этих символов на примерах, но вы должны знать, что существуют различные реализации регулярных выражений: POSIX, POSIX Extended, Perl, а также различные реализации нечетких регулярных выражений, гарантирующие вам головную боль.

5. Примеры использования sed

Синтаксис команды Описание

Sed "s/Nick/John/g" report.txt

Заменяет каждое вхождение Nick на John в файле report.txt

Sed "s/Nick\|nick/John/g" report.txt

Заменяет каждое вхождение Nick или nick на John.

Sed "s/^/ /" file.txt > file_new.txt

Добавляет 8 пробелов слева от текста для улучшения качества печати.

Sed -n "/Of course/,/attention you pay/p" myfile

Выводит все абзацы, начинающиеся с "Of course" и заканчивающиеся на "attention you pay".

Sed -n 12,18p file.txt

Выводит только строки 12-18 файла file.txt

Sed 12,18d file.txt

Выводит весь файл file.txt за исключением строк с 12 по 18
Вставляет пустую строку после каждой строки в file.txt

Sed -f script.sed file.txt

Записывает все команды в script.sed и выполняет их.

Sed "5!s/ham/cheese/" file.txt

Заменяет ham на cheese в file.txt за исключением 5-й строки

Sed "$d" file.txt

Удаляет последнюю строку

Sed -n "/\{3\}/p" file.txt

Печатает только строки с тремя последовательными цифрами

Sed "/boom/s/aaa/bb/" file.txt

Если найден "boom", заменить aaa на bb

Sed "17,/disk/d" file.txt

Удаляет все строки, начиная с 17-й, до "disk". Если строк с "disk" несколько, удаляет до первой из них.

Echo ONE TWO | sed "s/one/unos/I"

Заменяет one на unos независимо от регистра, поэтому будет напечатано "unos TWO"

Sed "G;G" file.txt

Вставляет две пустые строки после каждой строки в file.txt

Sed "s/.$//" file.txt

Способ замены dos2unix:). В общем случае удаляет последний символ в каждой строке.

Sed "s/^[ \t]*//" file.txt

Удаляет все пробелы/табы перед каждой строкой в file.txt

Sed "s/[ \t]*$//" file.txt

Удаляет все пробелы/табы в конце каждой строки в file.txt

Sed "s/^[ \t]*//;s/[ \t]*$//" file.txt

Удаляет все пробелы/табы в начале и в конце каждой строки в file.txt

Sed "s/foo/bar/" file.txt

Заменяет foo на bar только в первом вхождении в строке.

Sed "s/foo/bar/4" file.txt

Заменяет foo на bar только в четвертом вхождении в строке.

Sed "s/foo/bar/g" file.txt

Заменяет foo на bar для всех вхождений в строке.

Sed "/baz/s/foo/bar/g" file.txt

Заменить foo на bar только если строка содержит baz.

Sed "/./,/^$/!d" file.txt

Сжать все последовательные пустые строки до одной. Пустой строки сверху не остается.

Sed "/^$/N;/\n$/D" file.txt

Сжать все последовательные пустые строки до одной, но оставить верхнюю пустую строку.

Sed "/./,$!d" file.txt

Удалить все начальные пустые строки

Sed -e:a -e "/^\n*$/{$d;N;};/\n$/ba" file.txt

Удалить все замыкающие пустые строки

Sed -e:a -e "/\\$/N; s/\\\n/ /; ta" file.txt

Если строка заканчивается обратным сплешем, соединить ее со следующей (полезно для скриптов оболочки)

Sed -n "/regex/,+5p" file.txt

Выводит 5 строк после строки содержащей regex

Sed "1~3d" file.txt

Удалить каждую третью строку, начиная с первой.

Sed -n "2~5p" file.txt

Печатать каждую пятую строку, начиная со второй.

Sed "s/ick/John/g" report.txt

Другой способ записи некоторых приведенных выше примеров. Вы можете предложить свой?

Sed -n "/RE/{p;q;}" file.txt

Печатает строку с первым соответствием RE (регулярного выражения)

Sed "0,/RE/{//d;}" file.txt

Удаляет строку с первым соответствием

Sed "0,/RE/s//to_that/" file.txt

Изменяет только первое соответствие

Sed "s/^[^,]*,/9999,/" file.csv

Заменяет на 9999 все значения в первой колонке CSV-файла

S/^ *\(.*[^ ]\) *$/|\1|/; s/" *, */"|/g; : loop s/| *\([^",|][^,|]*\) *, */|\1|/g; s/| *, */||/g; t loop s/ *|/|/g; s/| */|/g; s/^|\(.*\)|$/\1/;

Скрипт sed для конвертирования CSV-файла в файл с вертикальной чертой в качестве разделителя (работает только с некоторыми типами CSV, со встроенными кавычками и запятыми).

Sed ":a;s/\(^\|[^0-9.]\)\(\+\)\(\{3\}\)/\1\2,\3/g;ta" file.txt

Меняет формат чисел в file.txt с 1234.56 на 1.234.56

Sed -r "s/\<(reg|exp)+/\U&/g"

Переводит любое слово, начинающееся с reg или exp в верхний регистр.

Sed "1,20 s/Johnson/White/g" file.txt

Производит замену Johnson на White только в строках 1 - 20.

Sed "1,20 !s/Johnson/White/g" file.txt

Предыдущий пример наоборот (заменяет везде, кроме строк 1-20)

Sed "/from/,/until/ { s/\<red\>/magenta/g; s/<blue\>/cyan/g; }" file.txt

Заменяет только между "from" и "until". Если областей "from"-"until" несколько, заменяет в каждой из них.

Sed "/ENDNOTES:/,$ { s/Schaff/Herzog/g; s/Kraft/Ebbing/g; }" file.txt

Заменяет только со слова "ENDNOTES:" и до EOF

Sed "/./{H;$!d;};x;/regex/!d" file.txt

Печатает абзац только если он содержит regex

Sed -e "/./{H;$!d;}" -e "x;/RE1/!d;/RE2/!d;/RE3/!d" file.txt

Печатает абзацы только если они содержат RE1, RE2 и RE3. Порядок RE1, RE2 и RE3 не имеет значения.

Sed "s/14"/fourteen inches/g" file.txt

Так вы сможете использовать двойные кавычки

Sed "s/\/some\/UNIX\/path/\/a\/new\/path/g" file.txt

Работа с путями Unix

Sed "s///g" file.txt

Удаляет все символы, начиная с a и заканчивая g из файла file.txt

Sed "s/\(.*\)foo/\1bar/" file.txt

Заменяет только последнее в строке соответствие foo на bar

Sed "1!G;h;$!d"

Замена команды tac

Sed "/\n/!G;s/\(.\)\(.*\n\)/&\2\1/;//D;s/.//"

Замена команды rev

Sed 10q file.txt

Замена команды head

Sed -e:a -e "$q;N;11,$D;ba" file.txt

Замена команды tail

Sed "$!N; /^\(.*\)\n\1$/!P; D" file.txt

Замена команды uniq

Sed "$!N; s/^\(.*\)\n\1$/\1/;t; D" file.txt

Обратная команда (что эквивалентно uniq -d)

Sed "$!N;$!D" file.txt

Эквивалент tail -n 2

Sed -n "$p" file.txt

... tail -n 1 (или tail -1)

Sed "/regexp/!d" file.txt

Эквивалент grep

Sed -n "/regexp/{g;1!p;};h" file.txt

Печатает строку, находящуюся перед первым соответствием регулярному выражению, но не включающую само соответствие

Sed -n "/regexp/{n;p;}" file.txt

Печатает строку, находящуюся после первого соответствия регулярному выражению, но не включающую само соответствие

Sed "/pattern/d" file.txt

Удаляет строки, соответствующие шаблону pattern

Sed "/./!d" file.txt

Удаляет все пустые строки из файла

Sed "/^$/N;/\n$/N;//D" file.txt

Сжимает все последовательные пустые строки до двух пустых. Одинарные пустые строки не изменяются.

Sed -n "/^$/{p;h;};/./{x;/./p;}" file.txt

Удаляет последнюю строку каждого абзаца
Получает заголовок письма. Другими словами - удаляет все после первой пустой строки.

НАЗВАНИЕ

sed — потоковый редактор

СИНТАКСИС

sed [-Ealn] command

sed [-Ealn] [-e command] [-f command_file] [-i extension]

ОПИСАНИЕ

Утилита sed читает указанный файл, либо стандартный ввод, если файл не указан,модифицирует ввод,как указано в списке команд. Затем, вход пишется на стандартный выход.Одна команда может быть указана, как первый аргумент sed. Множественные команды могут быть указаны использованием опций -e или -f. Все команды применяются в порядке их указания, вне зависимости от их происхождения. Доступны следующие опции:

Интерпретирует регулярные выражения как расширенные (современные), регулярные выражения чаще, чем основные регулярные выражения. Страница документации наre_format(7) полностью описывает оба формата.

Файлы перечисленные как параметры функции «w» создаются (или удаляются)прежде, чем начнется процесс по умолчанию. Опция -a заставляет sed откладывать открытие каждого файла до тех пор, пока команда содержащая связную функцию «w» не применяется к строке ввода.

Добавляет команды редактирования определенные аргументом command, к списку команд

Добавляет команды редактирования найденные в файле command_file к списку команд. Каждая команда редактирования должна быть перечислена в отдельной строке.

Редактирует файлы с замещением, сохраняя резервную копию с указанным расширением. Если расширение не указано (нулевой длины), резервная копия не будет сохраняться. Не рекомендуется присваивать нулевое расширение к замещаемым файлам, поскольку вы рискуете полностью или частично повредить файл, когда место на диске исчерпано.

создает буфер выходных строк.

по умолчанию, каждая линия ввода выводиться на стандартный вывод, после того как были применены все команды. Опция -n отменяет это поведение.

Форма команд sed следующая:

]function

Пробелы (whitespaces) могут быть вставлены до первого адреса и частями функции команды.

Обычно sed циклически копирует строку ввода, не включая завершающий символ новойстроки, в шаблон пробелов, (до тех пор, пока кто-нибудь не оставит «D» функцию) применяет все команды с адресами которые выбрали этот шаблон, копирует шаблон на стандартный вывод, добавляя символ новой строки и удаляя шаблон.

Некоторые функции используют hold space, для сохранения всего или части шаблона для последующего поиска.

Адреса Sed

Адрес не обязателен, но если он указан, то адрес должен являться номером (который считает строки входных файлов), знаком доллара (‘$’), который указывает на последнюю введенную строку или контекстный адрес (который содержит регулярное выражение,которому предшествует, и следует за ним, разделитель).

Командная строка без адресов выбирает каждый шаблон.Командная строка с одним адресом выбирает все шаблоны, которые совпадают с адресом.

Командная строка с двумя адресами выбирает включительный диапазон. Диапазон начинается с первого шаблона который совпадает с первым адресом. Конец диапазона следующий шаблон, который совпадает со вторым адресом. Если номер второго адреса равно или меньше номера строки первого, в таком случае эта строка будет выбрана.

В случае, когда второй адрес — контекстный адрес, sed не производит повторногосравнения второго адреса с шаблоном, который совпадает с первым адресом. Начиная с первой строки, сопровождаемой выбранным диапазоном, sed начинает поиск первого адреса снова.

Редактирование команд может применяться к невыбранным шаблонам, через использование символа («!»).

Регулярные выражения sed

Регулярные выражения используемые в sed, по умолчанию, являются основными регулярными выражениями (смотрите re_format(7), для более детальной информации), но вместо них могут использоваться раширенные (новые) регулярные выражения, если будет использован флаг -E.

Вдобавок, sed имеет следующие дополнения к регулярным выражениям:

1. В контекстном адресе, любой символ отличный от обратного слеша («\») или символа новой строки, может использоваться для разграничения регулярного выражения. Так же, использование обратного слеша перед разграничительным символом, заставляет символ являться литерой. Например, в контекстном адресе xabcxdefx,разграничивающим символом в регулярном выражении является «x», второй «x» будет являться литерой, поэтому регулярное выражение будет «abcxdef».

2. последовательности
совпадает с символом новой строки, встроенным в шаблон. Вы не можете использовать литеры символа новой строки в адресе, или команде подмены.

Единственной особенностью, присущей регулярным выражениям sed, является особенность быть, по умолчанию, по отношению к последему используемому регулярному выражению. Если регулярное выражение пустое, то есть, только указан разграничивающий символ, в таком случае будет использовано последнее использовавшееся регулярное выражение. Последнее регулярное выражение определяется как последнее использовавшееся регулярное выражение, как часть адреса или команды подмены, во время запуска, а не во время компиляции. Например, команда «/abc/s//XXX/» заменит «XXX» на шаблон «abc».

Функции sed

В следующем списке команд, максимальное количество разрешенных адресов для каждой команды показывается как , , или , представляя ноль, один или два адреса. Аргумент text содержит одну или более строк. Что бы включить символ новой строки в текст, поставьте перед ним символ обратного слеша. Другие символы обратного слеша в тексте удаляются и следующие за ними символы рассматриваются как литеры.

Функции «r» и «w» берут опциональный параметр файла, который должен быть отделен от функционального символа пробелом (whitespace). Каждый файл, заданный как аргумент для sed’а, создается (или содержимое его урезается) прежде, чем начнется любая обработка ввода.

Функции «b», «r», «s», «t», «w», «y», «!», и «:» принимают дополнительные аргументы. Следующий пример показывает, какие аргументы должны быть отделены из символов функций, пробелами (whitespaces).

Две функции составляют список функций. Список функций sed разделяется символами новой строки, как показано в следующим примере:

«{» может предворяться пробелом и сопровождаться пробелом. Функции могут предворяться пробелом. Звершающая «}» может пердворяться символом новой строки или пробелом.

Function-list Запускает список функций только, когда выбран шаблон.

text Записывает text в стандартный вывод незамедлительно, до попыток прочитать строку ввода, используется ли функция «N» или начинается новый цикл.

b Разветвляет функцию «:» определенным лейблом. Если лейбл не указан, разветвление происходит в конце скрипта.

text Удаляет шаблон. С 0 или 1 адреса, или диапазон 2 адресов, text выводится на стандартный вывод.

d Удаляет шаблон и начинает новый цикл.

D Удаляет начальный сегмент шаблона через первый символ новой строки и начинает новый цикл.

g Заменяет содержимое шаблона содержимым hold space.

G Добавляет символ новой строки, сопровождаемый содержимым hold space.

h Замещает содержимое hold space, сождержимым шаблона.

H Добавляет символ новой строки, сопровождаемы содержимым шаблона

i ext Записывает text на стандартный вывод.

l (буква эль). Записывает шаблон на стандартный вывод в визуально однозначной форме. Эта форма следующая:

обратный слэш \

возврат каретки

табуляция

вертикальня табуляция v

Непечатные символы записываются, как трехзначные восмеричные номера (предваряемые обратным слешем) для каждого байта в символе (наиболее важные байты сначала).

Длинные строки переносятся с указанием точки переноса в виде обратного слеша сопровождаемого символом новой строки. Конец каждой строки указан символом «$».

n Записывает шаблон на стандартный вывод если вывод по умолчанию не был переопределен, и заменяте шаблон следующей строкой ввода.

N Добавляет следующую строку к шаблону, используя встроенный символ новой строки, для разделения добавляемого материала от оригинального содержимого.

p Записывает шаблон на стандартный вывод.

P Записывает шаблон до первого символа новой строки, на стандартный вывод.

q Разветвляет конец скрипта и выходит без загрузки нового цикла.

r file Копирует содержимое file на стандартный вывод сразу же, прежде чем произойдет следующая попытка чтения строки. Если file не может быть прочитан, по любой причине, он тихо игнорируется и состояние ошибки не устанавливается.

s/regular expression/replacement/flags

Подменяет, замещаемую строку, первым регулярным выражением в шаблоне. Любой символ отличный от обратного слеша или символа новой строки может быть использован вместо обратного слеша или символа новой строки, вместо слеша, что бы разделить регулярное выражение и замещение. Внутри регулярного выражения и замещения, разделитель регулярных выражений сам может быть использован как литера, если он предварен обратным слешем.

Амперсанд («&») появляется в замене, если замещаемая строка совпадает с регулярным выражением. Особое значение «&» в этом контексте может быть изменено, предварением амперсанда обратным слешем. Строка «#», где «#» цифра, которая замещается текстом совпавшим с передачей обратного выражения.

Строка может быть разделена добавлением символа новой строки в нее. Для определения символа новой строки в замещаемой строке, предварите ее обратным слешем.

Значение flags в заменяемой функции — ноль или одна из следующих:

N Создавать замену только для N’ повторений регулярного выражения в шаблоне.

g Создавать замену для всех неперекрывающих совпадений регулярного выражения,не только для первого.

p Записывать шаблон на стандартный вывод, если сделано замещение. Если замещаемая строка совпадает с замещаемой, она все еще расценивается как замещение.

w Добавляет шаблон к file если замещение произошло. Если замещаемая строка совпадает с замещаемой, она все еще расценивается как замещение.

Разветвление функции «:» лейбл, если любая замена была сделана с момента нового чтения строки ввода или запуска функции «t». Если лейбл не определен,разветвление идет до конца скрипта.

w file Добавляет шаблон к file.

x Меняет содержимое шаблона и hold spaces.

y/string1/string2/

Замещает все повторения символа в string1 в шаблоне с соответствующими символами из string2. Любой символ, отличный от обратного слеша или символа новой строки может использоваться вместо обратного слеша или символа новой строки для разделения строк. Внутри string1 и string2 обратный слеш сопровождается любым символам отличным от символа новой строки, который является литерой и обратный слеш сопровождаемый «n» замещается символом новой строки.

Function

Function-list

Применяет функцию или список функций только для строк которые не выбраны адресом.

Эта функция ничего не делает, она вызывает лейбл в котором команды «b» и «t» могут разветвляться.

Записывает номер строки на стандартный вывод спопровождаемый символом новой строки.

Игнорирует пустые строки.

«#» и остаток строки игнорируются (расценивается как коментарий), с единственным исключением что если первые два символа в файле являются «#n», вывод по умолчанию подавляетс. То же самое, что и определение опции -n в командной строке.

Окружение

Переменные COLUMNS, LANG, LC_ALL, LC_CTYPE и LC_COLLATE препятствуют запуску sed ,как описано в environ(7).

Состояние выхода

утилита sed выходит с установкой 0 если выход прошел успешно, и >0 если возникли

Смотрите так же

awk(1), ed(1), grep(1), regex(3), re_format(7)

Стандарт

утилита sed, как ожидается, будет в наборе спецификаций EEE Std 1003.2 («POSIX.2»)

Опции -E, -a и -i не стандартны для расширений FreeBSD и могут быть недоступны для других операционных систем.

команда sed написана L. E. McMahon, появилась в Version 7 AT&T UNIX.

Мультибайтовые символы, содержащие значение 0x5C (ASCII `\’) могут быть распознаны

некорректно как продолжение символов строки в аргументах команд `a», «c» и «i»

Мультибайтовые символы не могут использоваться как разделители с командами