[질문]sed를 이용해서 img tag의 문자열 정렬을 하고 싶습니다.

divi의 이미지

본문 내용이 아래와 같습니다.

<img src="http://domain.com/common/iasdasdp.gif" alt="????" width="14" height="14"  onclick="onHelpClick();" style="cursor:pointer">
<img src="http://domain3.com/com/43sa4/34asdfp.jpg" alt="????" width="14" height="14"  onclick="onHelpClick();>
<img src="http://domain2.com/common/43sa4/34234/asdf/34a222sdfp.png">
<img src="http://domain123.com/43sa4/34234/asdf/34a222sd333fp.png?ݱ?">
<img src="http://domain123.com/43sa4/34234/asdf/34a222sd333fp.PNG???231">
<img src="http://xweqr.net/nblog/mylog/post/ico_file.JPEG????">{FILENAME}</p>

이걸 sed를 이용해서 아래와 같이 도메인 + 파일명으로 출력하고 싶습니다.

http://domain.com/common/iasdasdp.gif
http://domain3.com/com/43sa4/34asdfp.jpg
http://domain2.com/common/43sa4/34234/asdf/34a222sdfp.png
http://domain123.com/43sa4/34234/asdf/34a222sd333fp.png
http://domain123.com/43sa4/34234/asdf/34a222sd333fp.PNG
http://xweqr.net/nblog/mylog/post/ico_file.JPEG

확장자가 jpg||jpeg||gif||png||JPEG||JPG||GIF||PNG 뿐이라 이 확장자를 기준으로 뒤에 부분을 자르면 될 것 같은데요.. sed나 cut을 잘 쓰면 될것 같기도 한데.. 파일 확장자를 기준잡는 방법을 모르겠습니다.

그리고.. 도메인 + 서브디렉명까지만 자겨오는 방법도 궁금합니다.
고수님의 조언 부탁 드립니다.

ymir의 이미지

$ cat in.txt
<img src="http://domain.com/common/iasdasdp.agif" alt="????" width="14" height="14"  onclick="onHelpClick();" style="cursor:pointer">
<img src="http://domain.com/common/iasdasdp.agif" alt="????" width="14" height="14"  onclick="onHelpClick();" style="cursor:pointer">
<img src="http://domain.com/common/iasdasdpgif" alt="????" width="14" height="14"  onclick="onHelpClick();" style="cursor:pointer">
<img src="http://domain3.com/com/43sa4/34asdfp.jpg" alt="????" width="14" height="14"  onclick="onHelpClick();>
<img src="http://domain2.com/common/43sa4/34234/asdf/34a222sdfp.png">
<img src="http://domain123.com/43sa4/34234/asdf/34a222sd333fp.png???">
<img src="http://domain123.com/43sa4/34234/asdf/34a222sd333fp.PNG???231">
<img src="http://xweqr.net/nblog/mylog/post/ico_file.JPEG????">{FILENAME}</p>
$ cat in.txt | grep -Po "http://[^\s]+\.(gif|jpg|png|PNG|JPEG)"
http://domain3.com/com/43sa4/34asdfp.jpg
http://domain2.com/common/43sa4/34234/asdf/34a222sdfp.png
http://domain123.com/43sa4/34234/asdf/34a222sd333fp.png
http://domain123.com/43sa4/34234/asdf/34a222sd333fp.PNG
http://xweqr.net/nblog/mylog/post/ico_file.JPEG

html tag 안 먹히게 하는 것도 어렵네요.. ;;;

되면 한다! / feel no sorrow, feel no pain, feel no hurt, there's nothing gained.. only love will then remain.. 『 Mizz 』

divi의 이미지

이틀공안 고민했던 부분이 깔끔하게 해소되었습니다.

grep을 이렇게도 쓸수 있었네요.

저.. 혹시 디렉토리까지만 가져올 수 있는 방법도 있을까요?
cut을 쓰면 되겠지만 grep으로 좀 더 멋지게? 가져오는 방법을 아고 싶습니다.

grep 멋집니다.

감사합니다. ^^

IT를 강하게 하는 프레임워크 Cobit 4.1

ymir의 이미지

어렵게 regex 만드는 것보다 그냥 쉬운 방법을 쓰는게 나을 것 같네요.
grep 만으로 정교하게 걸러내시고 싶으시면 url regex 로 검색해 보세요.

$ cat in.txt | grep -Po "http://[^\s]+\.(gif|jpg|png|PNG|JPEG)" | xargs -I{} dirname {}
http://domain3.com/com/43sa4
http://domain2.com/common/43sa4/34234/asdf
http://domain123.com/43sa4/34234/asdf
http://domain123.com/43sa4/34234/asdf
http://xweqr.net/nblog/mylog/post
$ cat in.txt | grep -Po "http://[^\s]+\.(gif|jpg|png|PNG|JPEG)" | sed 's|/[^/]*$||'
http://domain3.com/com/43sa4
http://domain2.com/common/43sa4/34234/asdf
http://domain123.com/43sa4/34234/asdf
http://domain123.com/43sa4/34234/asdf
http://xweqr.net/nblog/mylog/post
$ cat in.txt | grep -Po "http://[^\s]+\.(gif|jpg|png|PNG|JPEG)" | rev | cut -d'/' -f2- | rev
http://domain3.com/com/43sa4
http://domain2.com/common/43sa4/34234/asdf
http://domain123.com/43sa4/34234/asdf
http://domain123.com/43sa4/34234/asdf
http://xweqr.net/nblog/mylog/post

되면 한다! / feel no sorrow, feel no pain, feel no hurt, there's nothing gained.. only love will then remain.. 『 Mizz 』

divi의 이미지

이제 감이 좀 잡히는 것 같습니다.

감사합니다. ^^
좋은 하루 보내세요.

IT를 강하게 하는 프레임워크 Cobit 4.1

divi의 이미지

역시 KLDP입니다.

IT를 강하게 하는 프레임워크 Cobit 4.1

댓글 달기

Filtered HTML

  • 텍스트에 BBCode 태그를 사용할 수 있습니다. URL은 자동으로 링크 됩니다.
  • 사용할 수 있는 HTML 태그: <p><div><span><br><a><em><strong><del><ins><b><i><u><s><pre><code><cite><blockquote><ul><ol><li><dl><dt><dd><table><tr><td><th><thead><tbody><h1><h2><h3><h4><h5><h6><img><embed><object><param><hr>
  • 다음 태그를 이용하여 소스 코드 구문 강조를 할 수 있습니다: <code>, <blockcode>, <apache>, <applescript>, <autoconf>, <awk>, <bash>, <c>, <cpp>, <css>, <diff>, <drupal5>, <drupal6>, <gdb>, <html>, <html5>, <java>, <javascript>, <ldif>, <lua>, <make>, <mysql>, <perl>, <perl6>, <php>, <pgsql>, <proftpd>, <python>, <reg>, <spec>, <ruby>. 지원하는 태그 형식: <foo>, [foo].
  • web 주소와/이메일 주소를 클릭할 수 있는 링크로 자동으로 바꿉니다.

BBCode

  • 텍스트에 BBCode 태그를 사용할 수 있습니다. URL은 자동으로 링크 됩니다.
  • 다음 태그를 이용하여 소스 코드 구문 강조를 할 수 있습니다: <code>, <blockcode>, <apache>, <applescript>, <autoconf>, <awk>, <bash>, <c>, <cpp>, <css>, <diff>, <drupal5>, <drupal6>, <gdb>, <html>, <html5>, <java>, <javascript>, <ldif>, <lua>, <make>, <mysql>, <perl>, <perl6>, <php>, <pgsql>, <proftpd>, <python>, <reg>, <spec>, <ruby>. 지원하는 태그 형식: <foo>, [foo].
  • 사용할 수 있는 HTML 태그: <p><div><span><br><a><em><strong><del><ins><b><i><u><s><pre><code><cite><blockquote><ul><ol><li><dl><dt><dd><table><tr><td><th><thead><tbody><h1><h2><h3><h4><h5><h6><img><embed><object><param>
  • web 주소와/이메일 주소를 클릭할 수 있는 링크로 자동으로 바꿉니다.

Textile

  • 다음 태그를 이용하여 소스 코드 구문 강조를 할 수 있습니다: <code>, <blockcode>, <apache>, <applescript>, <autoconf>, <awk>, <bash>, <c>, <cpp>, <css>, <diff>, <drupal5>, <drupal6>, <gdb>, <html>, <html5>, <java>, <javascript>, <ldif>, <lua>, <make>, <mysql>, <perl>, <perl6>, <php>, <pgsql>, <proftpd>, <python>, <reg>, <spec>, <ruby>. 지원하는 태그 형식: <foo>, [foo].
  • You can use Textile markup to format text.
  • 사용할 수 있는 HTML 태그: <p><div><span><br><a><em><strong><del><ins><b><i><u><s><pre><code><cite><blockquote><ul><ol><li><dl><dt><dd><table><tr><td><th><thead><tbody><h1><h2><h3><h4><h5><h6><img><embed><object><param><hr>

Markdown

  • 다음 태그를 이용하여 소스 코드 구문 강조를 할 수 있습니다: <code>, <blockcode>, <apache>, <applescript>, <autoconf>, <awk>, <bash>, <c>, <cpp>, <css>, <diff>, <drupal5>, <drupal6>, <gdb>, <html>, <html5>, <java>, <javascript>, <ldif>, <lua>, <make>, <mysql>, <perl>, <perl6>, <php>, <pgsql>, <proftpd>, <python>, <reg>, <spec>, <ruby>. 지원하는 태그 형식: <foo>, [foo].
  • Quick Tips:
    • Two or more spaces at a line's end = Line break
    • Double returns = Paragraph
    • *Single asterisks* or _single underscores_ = Emphasis
    • **Double** or __double__ = Strong
    • This is [a link](http://the.link.example.com "The optional title text")
    For complete details on the Markdown syntax, see the Markdown documentation and Markdown Extra documentation for tables, footnotes, and more.
  • web 주소와/이메일 주소를 클릭할 수 있는 링크로 자동으로 바꿉니다.
  • 사용할 수 있는 HTML 태그: <p><div><span><br><a><em><strong><del><ins><b><i><u><s><pre><code><cite><blockquote><ul><ol><li><dl><dt><dd><table><tr><td><th><thead><tbody><h1><h2><h3><h4><h5><h6><img><embed><object><param><hr>

Plain text

  • HTML 태그를 사용할 수 없습니다.
  • web 주소와/이메일 주소를 클릭할 수 있는 링크로 자동으로 바꿉니다.
  • 줄과 단락은 자동으로 분리됩니다.
댓글 첨부 파일
이 댓글에 이미지나 파일을 업로드 합니다.
파일 크기는 8 MB보다 작아야 합니다.
허용할 파일 형식: txt pdf doc xls gif jpg jpeg mp3 png rar zip.
CAPTCHA
이것은 자동으로 스팸을 올리는 것을 막기 위해서 제공됩니다.