全文検索エンジン Hyper Estraier 2 (333レス)
前次1-
抽出解除 レス栞

147
(1): fumiyas 2008/07/29(火)15:56 AAS
初心者板で聞いてきました。「&」って書くのね…。

pdftotext -enc UTF-8 -htmlmeta "$infile" - 2> "/dev/null" \
|sed '/<pre>/,/<\/pre>/{s/&/\&amp;/g;s/</\&lt;/g;s/>/\&gt;/g}' \
|output

その中に含まれる <, & を &lt;, &gt;, &amp; に変換してくれません(バグ)。
148
(1): 2008/07/30(水)18:50 AAS
>>147

す・すすごい!!できたできました!!(・∀・∀・)
ごっそり抜けちゃってた文章も、タグだと誤解されてしまってたんですね。
きちんとインデックスに戻ってきました、戻ってきましたよ!!щ(゜ロ゜щ) カモ-ン

天才ですかfumiyasさま… (シ_ _)シ ネ申 >>147
ほんにありがとうございます。

確かにインデックスの方には <pre> が単語化されているようですが、
これはもう、しょうがないですよ…ね…?

はぁぁ、感動しちゃいました。(;∀; )
前次1-
スレ情報 赤レス抽出 画像レス抽出 歴の未読スレ

ぬこの手 ぬこTOP 0.383s*