Regular Expression(正規表現) Part15

**デフォルトの名無しさん** · 2019/10/12(土) 19:38:36.96

>>16
お題スレの人が総当たりソルバー作ってくれた
https://mevius.5ch.net/test/read.cgi/tech/1564310397/757

**デフォルトの名無しさん** · 2019/10/29(火) 11:16:30.73

●Regular Expressionの使用環境
サクラエディタ　bregoning.dll ver 4.12

●検索か置換か？
置換

●説明
をふくむ行(複数）を削除

●対象データ
Ａ.jpg
B.jpg
C.jpg

●希望する結果
A.jpg

Ｂだけを削除するなら^.*B.*\nってわかるんですけど
Ｂ、Ｃを削除する方法がわかりません
誰か教えてください　よろしくお願いします

**デフォルトの名無しさん** · 2019/10/29(火) 11:28:33.00

>>40
いまいちやりたいことがはっきりしないが、
Aのみ残したなら、^[^AＡ].*?jpg¥n
BCのみ消したいなら、^[BC].*?jpg¥n

Aのみ全角なのは故意なのか？

**デフォルトの名無しさん** · 2019/10/30(水) 12:29:04.54

を含む行を削除
でググればすぐに見付かるんだが

ttps://yanohirota.com/regex-delete-row/
キーワードを含む行（複数指定） ^.*(キーワード1|キーワード2).*$(\r\n|\r|\n)?

**デフォルトの名無しさん** · 2019/10/31(木) 18:25:55.12

●Regular Expressionの使用環境
Mery
●検索か置換か？
置換
●説明
パターンにマッチする行までの全ての行をキャプチャしたい
●対象データ
20191001
吾輩は猫である
名前はまだ無い
……
20191002
親譲りの無鉄砲で
子供の頃から
損ばかりしている
……

●希望する結果
20191001[Tab]"吾輩は猫である
名前はまだ無い
……"
[改行]
20191002[Tab]"親譲りの無鉄砲で
子供の頃から
損ばかりしている
……"
日付と本文が交互に現れるテキストを日付と本文とに分けてキャプチャして置換したいのですが、上手く行きません。
最短一致を使用すると本文が一行しかキャプチャできないし、最長一致ですと最後の日付までの全行がキャプチャされてしまいます。
どうかご教示下さい。

**デフォルトの名無しさん** · 2019/10/31(木) 20:12:39.29

>43

検索
(^[0-9]{8})\n

置換
\n$1\t

**デフォルトの名無しさん** · 2019/11/01(金) 00:19:13.27

Ruby では、

text = <<"EOT"
20191001
あ
20191002
い
う
EOT

# キャプチャー部分の、#{ $1 } は、8桁の数字
p res = text.gsub( /^(\d{8})\n/ ) { "\n#{ $1 }\t" }
print res

出力
[空行]
20191001[Tab]あ
[空行]
20191002[Tab]い
う

**デフォルトの名無しさん** · 2019/11/01(金) 08:08:52.32

>>44
ご回答ありがとうございます。
すみません。本文部分を"で括りたくて、数字8桁に挟まれた部分にマッチさせたいのです。

**デフォルトの名無しさん** · 2019/11/01(金) 09:29:10.19

>>46
CotEditorでドットが改行に一致する状態なら以下でできる
(^¥d{8})(.*(?=¥n¥d{8})|.*(?=$))

Meryは知らん

**デフォルトの名無しさん** · 2019/11/01(金) 09:30:04.91

一応置換はこれ
$1¥t"$2"

**デフォルトの名無しさん** · 2019/11/01(金) 11:19:24.96

(^\d{8})\n((?~^\d{8}))$
\1\t"\2"
最後の行が改行されてると"がズレるからそこだけ手作業

**デフォルトの名無しさん** · 2019/11/01(金) 11:25:13.23

negative lookahead
https://regex101.com/r/DBWwcI/1

最下行に日付+改行を付け足せばORが一つ減って少し読みやすい
https://regex101.com/r/R3MQz7/1

**デフォルトの名無しさん** · 2019/11/01(金) 13:33:34.02

>>43
^([0-9]{8})\n((?:(?!\n[0-9]{8}\n)[\S\s])+)

**デフォルトの名無しさん** · 2019/11/01(金) 13:55:21.62

(?m)(^[0-9]{8}$)\n(.*?)(?=\n[0-9]{8}$|\Z)
(?m)(^[0-9]{8}$)\n(.*?)(?=\n[0-9]{8}$|\z)
↓
$1\t"$2"

**デフォルトの名無しさん** · 2019/11/01(金) 14:05:57.48

>>50
negative lookaheadとか書きつつ全然negativeじゃなかったわ

**デフォルトの名無しさん** · 2019/11/02(土) 07:00:29.25

皆様ありがとうございます
最短一致と先読みを組み合わせて
(\d{8})((?:.*\n)*?)(?=\d{8})
のような感じでマッチしました
単に.*だけだと行末までで止まってしまうので明示的に.*\nの繰り返しと指定しないといけなかったようです

**デフォルトの名無しさん** · 2019/11/18(月) 01:09:59.81

/(A|B*|C+|D?|E?|)+/ は /[A-E]*/ と同じなんだろうか。

**デフォルトの名無しさん** · 2019/11/23(土) 19:09:02.72

=を含まない行を検索できる表現方法は？

**デフォルトの名無しさん** · 2019/11/23(土) 21:06:16.66

>>56
^[^=]*$

**デフォルトの名無しさん** · 2019/11/24(日) 19:30:30.97

PCRE2 Version 10.34 21-November-2019
https://www.pcre.org/

**デフォルトの名無しさん** · 2019/12/07(土) 04:27:54.74

今でもアクティブに更新してるのってPCREの他はre2と鬼車系くらいなのかな
昔はライブラリの話も結構してた気がするけど

**デフォルトの名無しさん** · 2019/12/07(土) 11:10:24.58

Hyperscan

**デフォルトの名無しさん** · 2019/12/07(土) 19:19:38.35

テキストエディタで見えないけど何かがある状態
MacのBBEditだと逆さまの赤い「？」が表示される状態なんですけど
こういうのを正規表現で捕まえる事って出来ないですか？

**デフォルトの名無しさん** · 2019/12/07(土) 19:21:06.34

否定で出来ない？

**デフォルトの名無しさん** · 2019/12/07(土) 20:27:35.79

>>62
色々やってみたけど
非単語構成文字に含まれてしまい上手くこれだけ抽出出来ないです
一体こいつは何者なんだろう？もうちょい悩んでみます

**デフォルトの名無しさん** · 2019/12/07(土) 20:32:56.16

そういうときはバイナリエディタで開いて該当部の文字コード引きなよ。

**デフォルトの名無しさん** · 2019/12/07(土) 20:51:47.44

ありがとうです
\x{7F}
でいけました

**デフォルトの名無しさん** · 2019/12/07(土) 21:19:40.77

ウムラウトなどのアクセント付きアルファベットにのみ一致させる正規表現をお教えください。

**デフォルトの名無しさん** · 2019/12/07(土) 21:54:33.96

正規表現だけではまだできないんじゃないかな？

一般的には各言語が持ってるUnicodeの正規化機能を使って検索対象を基底文字＋結合文字の形に正規化してから、結合文字を検索する

**デフォルトの名無しさん** · 2019/12/07(土) 22:53:57.20

日本語なら、NKF というライブラリがあるように、
ウムラウトなら、その国のライブラリがあるかも知れない

知らないけど

まあ、日本人に聞いても、ムダだと思うw
使っている国の人に、聞いた方がよい

**デフォルトの名無しさん** · 2019/12/07(土) 23:41:45.44

cpanライブラリの中に一般的な正規表現集めたものがあるから
その中にあるかもね

**デフォルトの名無しさん** · 2019/12/08(日) 03:11:20.97

あるいは文字コードで標準ラテンのz（U+007A）よりあとを全て拾うように範囲指定するとか。

**デフォルトの名無しさん** · 2019/12/08(日) 12:38:28.10

>>66
数は知れてるんだから普通に[ÄäÏï …]ってやればいいんじゃね？

**デフォルトの名無しさん** · 2019/12/08(日) 14:00:42.26

サクラエディタの正規表現ライブラリbregonig with Onigmoの場合、大文字小文字区別なしでßや\x{00DF}がssにヒットするので困る。

**デフォルトの名無しさん** · 2019/12/08(日) 14:15:46.03

>>71
見た目が同じäでも文字コードの表現は複数ある
文字の種類も含めてこれで全部といえる集合を作れるならそれでいける
日本語で濁音が含まれる文字にのみ一致させる正規表現を求めてるのと似てる

**デフォルトの名無しさん** · 2019/12/08(日) 14:19:04.55

https://i.imgur.com/tclLTCk.png

**デフォルトの名無しさん** · 2019/12/08(日) 17:17:16.59

[=a=]
equivalence class

**デフォルトの名無しさん** · 2019/12/08(日) 17:27:54.65

●Regular Expressionの使用環境
鬼雲6.2.0 &Mery
●検索か置換か？
検索
●説明
行中の1個目の=にだけマッチさせたい
意味合いとしては
(?<=^[^=\n]+)=
なんだけど
>戻り読みの式は固定文字長でなければならない。
>しかし、最上位の選択子だけは異なった文字長が許される。
だそうで+はダメみたい
(?<=^(?~=))=
戻り読みの中に非包含もダメだった

(?<=^[^=\n]|^[^=\n]{2}|^[^=\n]{3}| .... |^[^=\n]{1000})=
とかすれば無理矢理出来そうだけどもっとスマートな書き方無いかな？

**デフォルトの名無しさん** · 2019/12/08(日) 17:35:15.85

^.*?\K=

**デフォルトの名無しさん** · 2019/12/08(日) 17:45:34.12

>>77
ありがとう
速っ。数日悩んであれこれ試してたのが嘘みたいなあっさり回答w
\Kとか意味分かってなかったけどこうやって使うんですね
重ね重ねありがとうございました

**デフォルトの名無しさん** · 2019/12/08(日) 18:23:57.85

>>75
それだとウムラウトついてないのも引っかかるよね

**デフォルトの名無しさん** · 2019/12/08(日) 22:21:07.36

\K
いいなそれと思ったけど自分の環境では使えなかった残念

**デフォルトの名無しさん** · 2019/12/09(月) 17:04:00.86

>固定文字長で >最上位の選択子だけは異なった文字長
これはこういう意味かな
(?<=^[^=\n]{1,1000})=

**デフォルトの名無しさん** · 2019/12/09(月) 21:21:57.03

鬼車のは (?<=ab|cd) だけじゃなく (?<=ab|cde) みたいなのも可ってことだったと思う

戻り読みを本当に後戻りしながらマッチングしてる実装ってほとんどなくて
大抵は文字列を一旦n文字分巻き戻して先読み相当の処理をするって感じになってるんで
パターンコンパイル時に「n文字分」が確定できない表現は弾かれる

**デフォルトの名無しさん** · 2019/12/11(水) 02:25:16.21

グレップ坊や　というソフト使ってますが
正規表現で、データだけ検索　データーを除外したい
どいう表記になりますか？

**デフォルトの名無しさん** · 2019/12/11(水) 02:56:43.47

データを表現する正規表現が基本
除外については反転オプションないの？
本家 grep には -v で反転する

**デフォルトの名無しさん** · 2019/12/11(水) 13:45:29.55

データ(?!ー)
データ(?=[^ー])
否定先読みか先読みが使えるならこれで出来る
独自のものだと適切なエスケープが必要かも
VB6ランタイム必要とあるからたぶんVBだろうけど

84 · 2019/12/14(土) 01:37:01.84

下のほうで行けました

**デフォルトの名無しさん** · 2020/01/02(木) 13:19:03.26

●Regular Expressionの使用環境
sed-4.7-x64.exe
(Gnu sed4.7のwindows版 https://github.com/mbuilov/sed-windows)
Windows 8.1(64)のPowerShellで実行

●検索か置換か？
置換(削除)

●説明
行頭から6文字目を削除して、行頭から2文字目の後に一文字挿入したい

●対象データ
1229日 1400
1230月 1500
1231火 1500

●希望する結果
12/29日1400
12/30月1500
12/31火1500

sed.exe -e "s/(?<=^.{5})\s//" .\ファイル.txt
としたら6文字目のスペースが削除されるかと思ったけどうまくいかない
ファイルはUTF-8で改行はCRLFです

**デフォルトの名無しさん** · 2020/01/02(木) 13:33:45.38

>>87
> うまくいかない
なぜどううまくいかないのかを書かないの？

**デフォルトの名無しさん** · 2020/01/02(木) 13:48:39.30

何も削除されずに元のファイルがそのままです。
エラー表示等はないです。

**デフォルトの名無しさん** · 2020/01/02(木) 16:53:21.09

^(.{2})(.{3}).(.*)$
$1/$2$3

**デフォルトの名無しさん** · 2020/01/02(木) 17:35:51.43

sed -i ？

**デフォルトの名無しさん** · 2020/01/02(木) 18:35:38.12

sed -E "s/^(..)(...)\s(.*)/\1\/\2\3/" .\ファイル.txt

**デフォルトの名無しさん** · 2020/01/13(月) 16:24:20.40

●Regular Expressionの使用環境
正規表現の本・テキストで疑問に思った部分ですので特に環境は無いです　

●対象データ
太郎はテニス部のキャプテンです。
太郎はサッカー部のキャプテンです。
太郎は野球部のキャプテンです。
太郎はバスケ部のキャプテンです。

●検索か置換か？
検索

●希望する結果
太郎はテニス部のキャプテンです。
太郎はサッカー部のキャプテンです。
太郎は野球部のキャプテンです。

●説明
通常の　太郎は(テニス|野球|サッカー)部のキャプテンです　では無く
バスケ　という単語を使い正規表現を作りたいのです
()を使った場合（使わなくても　バスケ　を用いた方法であれば良い）
の否定文・除くの書き方がわかりません
^ を使っってみましたが上手く行きませでした

太郎は(^バスケ)部のキャプテンです。　・・ダメ
太郎は^(バスケ)部のキャプテンです。　・・ダメ　　
太郎は(\^バスケ)部のキャプテンです。　・・ダメ

バスケ　を使った場合どの様に記述すれば良いのでしょうか？

**デフォルトの名無しさん** · 2020/01/13(月) 16:54:41.37

否定は、(?!文字列)
でも、太郎は(?!バスケ)部の、とは書けないよ
「太郎は」に続く「バスケでない任意の1文字以上の文字列」部のキャプテンという風に考えてみてくれ

**デフォルトの名無しさん** · 2020/01/13(月) 17:05:50.06

>>93
正規表現だけでは否定を完全実現できない。
だからこそ、例えばgrepには -vオプションがある。いずれのライブラリやアプリも正規表現とは別の方法で否定を実現している。

**デフォルトの名無しさん** · 2020/01/13(月) 17:19:50.81

太郎は(?!バスケ).*部のキャプテンです。
太郎は(?!バスケ).*
(?!.*バスケ)太郎は.*部のキャプテンです。
(?!.*バスケ)太郎.*
(?!.*バスケ).*

**デフォルトの名無しさん** · 2020/01/13(月) 17:32:26.06

鬼雲非包含
^(?~バスケ|\n)$

**デフォルトの名無しさん** · 2020/01/13(月) 18:15:40.74

太郎は(?!バスケ).*部のキャプテンです。
にて出来ましたが
(?!バスケ)　の扱いを　.*　でさらに処理しなきゃいけないのは全く思いつかないです
今回のを参考に今後も学習してみます

皆様　>>94->>97　ありがとうございました

**デフォルトの名無しさん** · 2020/01/13(月) 18:19:19.63

>>98
https://abicky.net/2010/05/30/135112/

**デフォルトの名無しさん** · 2020/01/14(火) 22:34:44.82

^(?!.*バスケ)(?=.*キャプテン)(?=.*太郎).*

**デフォルトの名無しさん** · 2020/01/15(水) 00:24:06.58

'あ'.match(/[あ゙い゙ゔえ゙お゙]/u)

（環境依存文字ですが、[]の中身は濁点つきの「あいうえお」です）
'あ'は濁点なしなのでマッチさせたくないのですがしてしまいます
これってマッチしないようにする方法はないですか？
JavaScriptです

**101** · 2020/01/15(水) 00:30:34.00

>>101 自己解決しました

'あ'.match(/\u3099/u) //マッチしない
'あ゙'.match(/\u3099/u) //マッチする

**デフォルトの名無しさん** · 2020/01/15(水) 12:08:15.81

^(?!.*バスケ(?!ット(?!ボール(?!選手)))).*
バスケ　　　　　　　　　　←不一致
バスケット　　　　　　　　←一致
バスケットボール　　　　←不一致
バスケットボール選手　←一致
太郎はバスケットボール選手としてバスケ部に入部している　←不一致
太郎はバスケットボール選手としてバスケット部に入部している　←一致

**デフォルトの名無しさん** · 2020/01/15(水) 14:36:24.87

んなことよりバスケやろうぜ

**デフォルトの名無しさん** · 2020/02/09(日) 22:06:03.00

マッチしたカッコ内の文字列をを利用する方法ってどうやるんでしたか？

http://hogehoge.jp
http://(.*).jp

このアスタリスクの部分を利用するのはどうやるんでしたかね
t1ではないです

**デフォルトの名無しさん** · 2020/02/09(日) 22:18:21.72

>>105
>>2
> スルーされにくい質問のテンプレと例
> ●Regular Expressionの使用環境

**デフォルトの名無しさん** · 2020/02/09(日) 22:22:12.18

＄１ですねどうも

**デフォルトの名無しさん** · 2020/02/09(日) 22:34:23.16

同じ行にあるurlにhrefを加える正規表現はどうするのでしょうか

http://hoge1.jp http://hoge2.jp
↑これを
<a href="http://hoge1.jp";>http://hoge1.jp<;/a> <a href="http://hoge2.jp";>http://hoge2.jp<;/a>
こうしたいです

１つだけならこうできます
http://(.*).jp

**デフォルトの名無しさん** · 2020/02/09(日) 22:34:49.85

http://$1.jp
を忘れていました

**デフォルトの名無しさん** · 2020/02/10(月) 14:37:14.41

正規表現よりも、HTML パーサーの方がよい。
Ruby のnokogiri で、HTML をパースすると、

require 'nokogiri'

doc = Nokogiri::HTML(<<EOT)
<html><body>
<a href="http://hoge1.jp";>http://hoge1.jp<;/a>
<a href="http://hoge2.jp";>http://hoge2.jp<;/a>
</body></html>
EOT

elements = doc.css( "a" )

# 属性・テキスト
elements.each { |elem| puts elem.get_attribute( "href" ), elem.text }

出力
http://hoge1.jp
http://hoge1.jp
http://hoge2.jp
http://hoge2.jp

**デフォルトの名無しさん** · 2020/02/10(月) 18:02:57.53

>>110

>>108はHTMLをパースしたいんじゃなく
HTMLの一部を生成したいんじゃろ

**デフォルトの名無しさん** · 2020/02/11(火) 07:15:58.31

>>108
.jpが末尾につく行がリンクだと仮定してjavascript

/^(.+\.jp)$/gm

上記の正規表現で

<a hef=“http://$1”>http://$1<;/a>

正規表現のフラグのmで複数行対応、gで複数の結果で対応出来ん？

**デフォルトの名無しさん** · 2020/02/11(火) 13:30:47.89

(https?://\S+)
<a href=“\1”>\1</a>

**デフォルトの名無しさん** · 2020/02/12(水) 09:21:48.77

1) (hoge)
2) (hoge, fuga)
3) (hoge, fuga, piyo)

2) のみにマッチする正規表現のご教示よろしくお願いいたします

鬼雲

**デフォルトの名無しさん** · 2020/02/12(水) 10:28:49.15

hogeとfugaを後で使うと仮定して
$(.+),(.+)$

**デフォルトの名無しさん** · 2020/02/12(水) 10:51:06.48

>>115
それだと3)にもマッチするよ

**デフォルトの名無しさん** · 2020/02/12(水) 11:05:14.78

>>114
a\)

**デフォルトの名無しさん** · 2020/02/12(水) 15:06:59.76

.を[^,]でどう？

**デフォルトの名無しさん** · 2020/02/12(水) 15:37:27.75

ID:bUEb5r3d 様
ありがとうございました。m(_ _)m

「$[^,]*,[^,]*?$」で希望動作になりました

**デフォルトの名無しさん** · 2020/02/12(水) 18:44:57.81

どういたしまして。

ちなみに+じゃなくて*にしてるのは
(,)
にも一致させたいという事？
あと?は無くても動かん？

**デフォルトの名無しさん** · 2020/02/12(水) 18:51:28.08

[^,]*だと改行と閉じ括弧を含んでしまい
次の行まで選択してしまうのでは？

**デフォルトの名無しさん** · 2020/02/12(水) 19:37:56.96

確かにこんなデータも想定するとアウトやね

((hoge,huga)piyo)

改行はオプション次第だね

**デフォルトの名無しさん** · 2020/02/18(火) 23:17:54.25

指定した2つの文字XYの間がn文字以下(0を含む)にマッチする検索方法教えてください

マッチ例n=3
XY
XaY
XabcY

NG
XabcdY

**デフォルトの名無しさん** · 2020/02/18(火) 23:50:11.22

X.{0,3}Y
とかかな、試してないけど

**デフォルトの名無しさん** · 2020/02/19(水) 00:18:10.76

>>124
ありがとうございます

**デフォルトの名無しさん** · 2020/02/24(月) 14:31:40.12

●Regular Expressionの使用環境
実際に使う環境は不明ですが、まずはサクラエディタで試そうと思います。

●検索か置換か？
検索。マッチ部分を抽出できる必要はなく、含むかだけわかれば良いです。

●説明
文章(サクラは複数行NGとのことなので、今は1行)の中に「市」という文字が入っているかを判定したいです。
しかし、「横浜市」のような地名が入っているかを判定したいので、「巨大都市」「姉妹都市」のような特定のワードは排除したいです。
>>103の前後が逆のパターンになると思うのですが、単純に「^(?!.*(?!(?!巨大都|姉妹都)市)).*」とすると何もマッチしなくなってしまいます。
(そもそも「^(?!.*(?!ット(?!ボール))).*」の時点で「バスケット」にマッチしません)

●対象データ・希望する結果
ここは巨大都市だ
(マッチなし)
ここは横浜市だ
　　　　　^
ここは巨大都市の横浜市だ
　　　　　　　　　　^

**デフォルトの名無しさん** · 2020/02/24(月) 14:48:12.43

>>126
(?<!巨大都|姉妹都)市

Negative Lookbehindを使う
https://regex101.com/r/kP6luP/1

**126** · 2020/02/24(月) 15:48:38.69

>>127
できました、ありがとうございます
後読みというのもあるんですね

**デフォルトの名無しさん** · 2020/03/21(土) 15:01:32.98

どなたか教えてください。0が含まれる行のみ／以降を削除したいです。

（処理前）
2／3004
67／／1
503／11／4
4／6／978

（処理後）
2
67／／1
503
4／6／978

実際の文字列は数字とは限りません。可能かわかりませんがどうぞお願いします。

**デフォルトの名無しさん** · 2020/03/21(土) 16:32:31.37

>>129
使用環境も書きましょう。
プログラミング言語かテキストエディタかでも大分違ってきますし。

スルーされにくい質問のテンプレと例

●Regular Expressionの使用環境
Java1.5

●検索か置換か？
検索

●説明
各行の1番目のAまでを検索したい

●対象データ
ABCA
BCAA
CABA

●希望する結果
ABCA
^
BCAA
^^^
CABA
^^

※ ^ はアンダーラインだそうな ^^;

**デフォルトの名無しさん** · 2020/03/21(土) 16:58:05.15

^(?=.*0)([^／]*).*$
\1

**デフォルトの名無しさん** · 2020/03/21(土) 18:17:29.30

>>131
すごい！完璧に希望どおりにできました！
アリガトウゴザイマス！！！

**デフォルトの名無しさん** · 2020/03/22(日) 11:16:42.62

●Regular Expressionの使用環境
VisualWorks 7.7NC Regex11パーセル

●検索か置換か？
検索

●説明
jpgファイルの連番部分を取り出したい

なお正規表現にいくつか制約があります
先読みと後読みはできません　(?= (?! (?<= (?<! などが未実装
最小一致も実装されていません
グループやキャプチャは可能です

'.*:^isDigit:(:isDigit:+)¥.(:isAlphabetic:+)$' asRegex. などとやっていましたが
これだと3333.jpgなどのパターンに対応できないので
'.*:^isDigit:?(:isDigit:+)¥.(:isAlphabetic:+)$' asRegex.
とやるとそもそもマッチしません
正規表現だけでやるうまい方法が見出せませんでした
isDigitは ¥d
isAlphabeticは [a-z] と読み替えできます

●対象データ
0000_1111_2222_3333.jpg
_0000_1111_2222_3333.jpg
3333.jpg

●希望する結果
3333
3333
3333

**デフォルトの名無しさん** · 2020/03/22(日) 11:49:39.63

0000などは連番扱いされないの？

**デフォルトの名無しさん** · 2020/03/22(日) 11:55:19.77

>>133
正規表現の方言がマイナー過ぎて難しい
:^isDigit: はPerl5でいう [^0-9] と等価という理解で合ってる？

**デフォルトの名無しさん** · 2020/03/22(日) 12:16:09.69

ファイル名の最後の数字部分だけ取りたいなら　(\d+).jpg とかじゃ駄目なん？

**デフォルトの名無しさん** · 2020/03/22(日) 12:33:09.14

>>133
そもそも :^isDigit: の前に .*は必要？

**デフォルトの名無しさん** · 2020/03/22(日) 12:39:04.69

>>134
その辺は捨てます
拡張子直前の数字だけを連番扱いです

>>135
それでいいです
書き方が変わってますが考え方は一緒です

>>137
ないとマッチしませんでした

**デフォルトの名無しさん** · 2020/03/22(日) 12:41:01.29

>>136
試しましたがマッチしません

**デフォルトの名無しさん** · 2020/03/22(日) 12:43:52.41

書き忘れましたが
ファイル名だけでなくファイルパスを含む場合があります・・

ex.
/a/b/c/d/_0000_1111_2222_3333.jpg

3333.jpgのようなパターンさえなければ対応できているのですが
これが来た場合にうまくいきません

**デフォルトの名無しさん** · 2020/03/22(日) 13:22:29.93

>>139

>>136のだと
拡張子のピリオドがエスケープされてないから
(\d+)\.jpg
でキャプチャ箇所を抽出すればよいのでは？

**デフォルトの名無しさん** · 2020/03/22(日) 13:27:20.03

>>141
エスケープ付けてテストしてあります

**デフォルトの名無しさん** · 2020/03/22(日) 13:29:10.24

>>140
(/a/b/c/d/_0000_1111_2222_)?3333.jpg

**デフォルトの名無しさん** · 2020/03/22(日) 13:33:55.99

>>143
マッチします

**デフォルトの名無しさん** · 2020/03/22(日) 13:53:17.55

>>138
メソッドは何を使っているの
メソッドによって「文字列の先頭で一致する」とか
「文字列の任意の場所で一致する」とかあるでしょ
前者を使っているのでは?
後者なら>>136の類で上手く行くと思う

さもなくば ^(|.*:^isDigit:)(:isDigit:+)\.(:isAlphabetic:+)$ でどうかな

**デフォルトの名無しさん** · 2020/03/22(日) 14:25:12.02

JavaScript なら、これで一致するので、
キャプチャー部分だけを取り出す

var re = /(\d+)\.jpg/g;

**デフォルトの名無しさん** · 2020/03/22(日) 14:31:11.47

文字列の先頭からしかマッチできないんなら .*(\d+).jpg でいいんじゃね
ルールがローカルすぎてよくわからんが

**デフォルトの名無しさん** · 2020/03/22(日) 14:42:52.35

>>133
>これだと3333.jpgなどのパターンに対応できない
ORでそのパターンをカバーしてやればいいよね

**デフォルトの名無しさん** · 2020/03/22(日) 14:50:15.15

(.*[^\d])?(\d+)\.jpg

**デフォルトの名無しさん** · 2020/03/22(日) 15:07:09.29

>>145
先頭からスキャンするメソッドしかないようです
試して見たところうまく行きそうなのでテストしています
あまり関係ないですがisDigitやisAlphabetic自体がメソッド名で
char.isDigit(); みたいに内部的に呼ばれています

>>147
それだと最長一致の関係で
3333のうち3だけ取り出されてしまいます

>>149
こちらもうまく行きそうです

後ほど結果ご報告致します

**デフォルトの名無しさん** · 2020/03/22(日) 15:21:27.08

(.*[^\d])?(\d+)\.jpe?g
\2

**デフォルトの名無しさん** · 2020/03/22(日) 15:30:56.06

一通り検査して全てパスできました
皆様ありがとうございました

それにしてもうまい方法があるものですね勉強になります・・

**デフォルトの名無しさん** · 2020/03/22(日) 21:42:28.57

>>133を見て何が何だかだわ
皆さんスゲーな

**デフォルトの名無しさん** · 2020/03/23(月) 07:21:58.66

VSCode なら、Regex Previewer という拡張機能がある

JavaScript, PHP の正規表現をテストできる

**デフォルトの名無しさん** · 2020/04/09(木) 01:23:43.84

正規表現の段位、級位みたい試験があると転職に役立つかな
正規表現３段所持みたいな
試験問題はほとんどパズルだな

当方は頭悪いので、複数の単純な正規表現使用派

**デフォルトの名無しさん** · 2020/04/09(木) 14:34:47.92

正規表現必須！てな現場もそうそう無いだろうし
使えて当たり前、だけど高度過ぎる常人に思い付けないようなものが必要になる場面もまず無いだろうし
そうなったら出来る奴に丸投げすりゃいいし
プログラム内なら全て正規表現任せにせずに前処理した方が良いケースも多々あるからそれ絡めてのスキルだと思うし
方言が多い事や解が複数あり得る事も試験化には問題
マークシート選択方式では引っ掛け問題ばかりになるだろうし何か違う気がする
資格化したところで精々、文系脳の奴がどれだけ論理思考が出来るか？の目安とか雑なIQ判定くらいにしか役立ちそうにない
義務教育内でこんなのあるよ程度に最低限くらいは教えておいて欲しいけど資格化までは疑問かな

**デフォルトの名無しさん** · 2020/04/09(木) 18:11:21.90

>>156
君は正規表現の前に日本語の義務教育受けてこいw

**デフォルトの名無しさん** · 2020/04/09(木) 21:20:08.08

日本語力に特段問題があるようには見えないが

**デフォルトの名無しさん** · 2020/04/09(木) 21:34:35.21

俺もちゃんと何言ってるのか分かったし、特に読んでて疑問も覚えなかったね

**デフォルトの名無しさん** · 2020/04/09(木) 22:20:15.44

文章がくどいとは思う

**デフォルトの名無しさん** · 2020/04/09(木) 22:26:46.58

難題を解決したらあいつスゲーなとなるけど
なかなかその機会が訪れないよな

**デフォルトの名無しさん** · 2020/04/09(木) 23:07:21.92

>>160
くどいというより接続詞で繋げすぎだね

**デフォルトの名無しさん** · 2020/04/10(金) 05:35:38.69

論文とかの文章ならどうかと思うけど
こういう掲示板での改行の仕方とか含めての表現では
別に問題ないよなと思った

**デフォルトの名無しさん** · 2020/04/10(金) 07:01:05.28

義務教育やり直せレベルにはみえない
雑文としては意味が通じないような文では無いだろう
157の日本語力が低杉なんじゃ？

**デフォルトの名無しさん** · 2020/04/10(金) 08:59:24.36

>>161
パズルとしてはいいけど業務でやられると保守できなくなるしな

**デフォルトの名無しさん** · 2020/04/10(金) 09:02:57.81

>>157フルボッコw
最初の方で「~し」を多用してるのがちょいウザいけど内容的にはまあ頷けるわな

**デフォルトの名無しさん** · 2020/04/10(金) 11:44:30.56

>>161
そいつじゃないとできないっていう状況を会社は嫌がるからね
いつやめるかもわからんし
資産がゴミ化してしまうのを恐れる

**デフォルトの名無しさん** · 2020/04/10(金) 14:42:19.38

そもそも問題が複雑だから複雑な正規表現になってしまうのでは?
そういう場合はそいつじゃないとできないという状況になってしまうこともありうる

**デフォルトの名無しさん** · 2020/04/10(金) 15:00:43.02

うん、そういう場合もあると思うけど
多くの人はそもそも正規表現で解決出来るかもという発想がなくて
手間と時間をかけて頑張るか、その仕事を断る
そんな場合が多い気がする

**デフォルトの名無しさん** · 2020/04/10(金) 15:25:33.75

まあbison/flex使って片付けてたらそれはやめてくれとも言われたこともあるしな
引き継げないだろと

**デフォルトの名無しさん** · 2020/04/10(金) 16:34:01.15

>>168
一例として…

頑張れば1つにまとめられる
でも場合分けすればコードは長くなるし性能も劣化するけどわかりやすく書ける

って言うケースはそれなりにあると思うよ

**デフォルトの名無しさん** · 2020/04/10(金) 23:03:46.23

頑張りすぎちゃって誰もメンテできないような手に負えないSQLってたまに出くわすけど、
それと同じような要領で頑張りすぎちゃって誰もメンテできないような正規表現が出てきたら・・・・
自分だったらSQLのときよりもさらに全力で逃げ出すかなあ

正規表現ってただでさえ魔法のような暗号文化しがちだし（後で読解に困ることも多いし）
仕様を簡潔明瞭にコードに落とし込むスキルがないダメプログラマが
力技で正規表現ゴリゴリ書くことを考えるとかなりの恐怖
エスアイアーの現場ならむしろ安全のため正規表現全面禁止にしておくほうがマシなんじゃなかろうか

**デフォルトの名無しさん** · 2020/04/11(土) 00:23:01.95

三項演算子でも同じ問題あるね
可読性と簡潔性は必ずしも両立しない

**デフォルトの名無しさん** · 2020/04/11(土) 00:37:32.49

仕様がわかっていれば
ちゃんとしたドキュメントが残っていれば何とでもなる
暗号をわかりやすいプログラムに変換可能だから
とりあえず動いているので触りたくないというのどうにもならない
それはそのプログラムが近い将来破綻することを意味する

**デフォルトの名無しさん** · 2020/04/11(土) 01:03:41.61

>>172
正規表現は仕様の分かるテストケース一式を必ず用意させれば問題ない

つまり難しい正規表現を使いこなす能力よりも
もれなくテストケースを書ける能力のほうが大事

**デフォルトの名無しさん** · 2020/04/11(土) 05:53:16.03

>>175
あーあーそれはなんか分かる・しっくり来るな。完全同意だわ。

**デフォルトの名無しさん** · 2020/04/11(土) 09:32:41.81

>>175
でもそれって正規表現使っているか否かに関わらず本来なされているべきことだよね
正規表現とか特定の機能を使ってるところだけ特別扱いしてドキュメントやテスト仕様を残させるとか
絶対サボる人が出てきそう
でもってサボったところに限って誰も直せないようなクソコードと化すパターン

**デフォルトの名無しさん** · 2020/04/11(土) 16:30:10.27

>>177
仕様の分かるテストケースってのはテストコードのことね
正規表現は作る時に必ずマッチする例とマッチしない例を書いて確認するでしょ？
それを仕様の分かるテストコードにしてセットで扱えるようにしておくってこと
コードレビュー時も正規表現だけ見てレビューしても効果薄いから
テストコードとセットでレビューする

>でもそれって正規表現使っているか否かに関わらず本来なされているべきことだよね
これはそうでもないよ
複雑なSQLの場合は仕様の分かるテストコードを一式用意するのは結構難しくて
ある範囲を超えると手間に見合わないから仕様書とSQL自体のレビューだったり手動テストで補完する
正規表現は純粋関数として扱えるのでその辺の難しさがない

**デフォルトの名無しさん** · 2020/04/14(火) 11:27:53.60

足並み揃えないと不安で死んじゃう病

**デフォルトの名無しさん** · 2020/04/14(火) 11:37:16.46

人っていついなくなるかわからないからね
事故だったり勝手な理由で辞めたり

**デフォルトの名無しさん** · 2020/04/15(水) 10:44:15.36

●Regular Expressionの使用環境
grep (GNU grep) 2.20

●検索か置換か？
検索

●説明
今日から、14日間（位）を抜き出したい。

●対象データ
(前にもたくさん)
2020-03-14
2020-03-14
2020-03-15
2020-03-15
(中略)
2020-04-14
2020-04-14
2020-04-15
2020-04-15
(後も続く)

●希望する結果
14日前から2020-04-15を抽出できる事を希望します。
元ファイルに存在しない日付（3月33日があったり・・）などは無く、書式も必ず対象データに記載のもので出力されます。
また、30の月、31の月なども考慮しないでOKです。（できる限りシンプルな書式でお示しください）
サンプルお示しいただけたら、あとはググりながら自分で調べます。

ググったのですが、サンプルになるいい感じのシンプルな書式が見当たらず
どうにもうまく正規表現を作れずにおります。何卒宜しくお願い致します。

**デフォルトの名無しさん** · 2020/04/15(水) 11:13:15.42

カレンダーは西向く侍があるから正規表現単独では無理では……

**デフォルトの名無しさん** · 2020/04/15(水) 11:16:23.86

>>181
意味がよくわからんが、
任意の日付から14日前(後?)を抜き出すってことなら
正規表現よりはscriptの領域だろ。

**デフォルトの名無しさん** · 2020/04/15(水) 11:19:34.98

>>182
大体でもできないでしょうか。
と書こうと思ったときに思いつきました。。。

実行速度に問題が出るかもしれませんが、
3月15日または、3月16日または、3月17日または・・・4月15日。

って力技でやってみます・・・。

もし、ほかにも「こういう方法があるよ」って素敵なアイデアお持ちのかた
いらっしゃいましたら、ぜひレスをください。宜しくお願い致します。

**デフォルトの名無しさん** · 2020/04/15(水) 11:29:40.68

>>184
そもそも4/15から14日前で何で3月が入るんだよ。
間飛んでる可能性があるって事？
だとすればなおさら正規表現向きではない。

**デフォルトの名無しさん** · 2020/04/15(水) 11:31:48.22

>>185
すみません、そこは書き間違えです。
awkってコマンドでできそうなので
もう少し調べてみます。

スレ汚し失礼いたしました。

**デフォルトの名無しさん** · 2020/04/15(水) 11:48:04.80

>>186
3/15～4/15限定での力技なら
2020(¥-03¥-(1[5-9]|2[0-9]|3[0-1])|¥-04¥-(0[1-9]|1[0-5]))

**デフォルトの名無しさん** · 2020/04/15(水) 11:49:07.49

>>183
ありがとうございます。
scriptというのが大きなヒントになり解決に至りました。

結果的にはこれでできました。
cat 対象ログファイル | awk '"2020-04-01" <= $2 && $2 < "2020-04-02"'

性器表現ばっかりにとらわれてました・・
ありがとうございます。

**デフォルトの名無しさん** · 2020/04/15(水) 13:19:12.50

何を言いたいのかエスパーでもわからん
オーダーはもっと正確に

**デフォルトの名無しさん** · 2020/04/15(水) 16:37:41.08

>>181
ちょっとだけややこしい検索にはawkがおすすめ

**デフォルトの名無しさん** · 2020/04/15(水) 16:53:34.03

性器表現って(i)みたいなのだろｗ

**デフォルトの名無しさん** · 2020/04/21(火) 11:40:37.33

●Regular Expressionの使用環境
サクラエディタ

●検索か置換か？
置き換え

●説明
pingの結果（成功）をtxtに収めたものから、
IPアドレスだけ抜き取りたい

●対象データ
Echo reply 1 from 192.168.0.1 time delay 99.999 ms
Echo reply 2 from 192.168.0.1 time delay 88.999 ms
Echo reply 1 from 192.168.0.2 time delay 88.999 ms
Echo reply 2 from 192.168.0.2 time delay 88.999 ms
以下同じように続く

●希望する結果
192.168.0.1
192.168.0.1
192.168.0.2
192.168.0.2

〇実際に得られた結果
2.168.0.1
2.168.0.1
2.168.0.2
2.168.0.2

よろしくお願いいたします。

**デフォルトの名無しさん** · 2020/04/21(火) 11:41:25.90

〇使用した正規表現(置換)
.*((([0-9]{1,3}\.){3})[0-9]{1,3}).*
$1

が抜けてました

**デフォルトの名無しさん** · 2020/04/21(火) 12:43:11.20

今の奴を少し手直しして
.*\b(([0-9]{1,3}\.){3}[0-9]{1,3}).*
とか
.* (([0-9]{1,3}\.){3}[0-9]{1,3}).*

必ずfrom～timeに挟まれるなら
.*from ([\d.]*) time.*
とか

**デフォルトの名無しさん** · 2020/04/21(火) 13:08:13.53

>>193
とても意味がわかって書いているとは思えないが。
ログがそのパターンだけならこれでいけるでしょ。
¥d+¥.¥d+¥.¥d+¥.¥d+
頭が192.168.だけならそれで絞ってもいいし。

**デフォルトの名無しさん** · 2020/04/21(火) 13:34:44.69

>>194
両方ばっちりうまくいきました。
ありがとうございます。

\dとか\bとかいろいろあるんですね。
\t位しか知りませんでした。
ありがとうございます。

**デフォルトの名無しさん** · 2020/04/21(火) 22:38:03.26

.* を [^0-9]* もしくは \D*

**デフォルトの名無しさん** · 2020/04/21(火) 23:03:33.07

推奨はしないけど、元の奴で、.*に?を追加して
.*?((([0-9]{1,3}\.){3})[0-9]{1,3}).*

**デフォルトの名無しさん** · 2020/05/16(土) 15:22:19.43

ランダムな文字列によるコピペ荒らしで
12文字中の文字が最大で6種類しかない
ようなときどうすればいいでしょうか？

(.)\1*([^\1])\2*([^\1\2])\3*([^\1\2\3])\4*([^\1\2\3\4])\5*(
[^\1\2\3\4\5])\6 (.)\1*([^\1])\2*([^\1\2])\3*([^\1\2\3])\4*([^\1\2\3\4])\5*(
[^\1\2\3\4\5])\6*[\1\2\3\4\5\6]{6,}

こんな風にすると新たな種類の文字がキャプチャされていくように思えますが
既に登場した文字が再び登場するとマッチしなくなります

**デフォルトの名無しさん** · 2020/05/16(土) 15:33:21.77

例を挙げると

↓慮↓鸞↑↓↓→慮↑←←↑→↑鸞↑→←→艪慮慮↑鸞鸞慮慮艪艪鸞→→↑慮↓→↓↓↑
慮鸞鸞艪艪→慮鸞艪鸞鸞↑慮艪慮艪慮↑←慮↑↑慮↑←艪→←鸞↑↓↑↑↓艪↓鸞慮→→
→艪←艪←↓↓←艪←↑→←←←鸞↓↓艪↑鸞←鸞←↓慮鸞←慮←慮↓慮慮慮慮↓↑艪

こんな感じの荒らしです
文字は毎回ランダムで変わります
登場する文字の種類が少ないという点でマッチさせたいと思っています

**デフォルトの名無しさん** · 2020/05/16(土) 15:34:13.39

(.)\1*([^\1])[\1\2]*([^\1\2])[\1\2\3]*([^\1\2\3])[\1\2\3\4]*([^\1\2\3\4])[\1\2\3\4\5]*
こんな感じ？

**デフォルトの名無しさん** · 2020/05/16(土) 19:45:32.29

>>201
試したらそれだとほぼ全ての文章にも当てはまるみたいです

**デフォルトの名無しさん** · 2020/05/16(土) 20:00:27.44

^(.)+(?!\1)(.)(?:\1|\2)*(?!\1|\2)(.)(?:\1|\2|\3)*(?!\1|\2|\3)(.)(?:\1|\2|\3|\4)*
文字クラス中で後方参照使えないなら否定先読みで代替

**デフォルトの名無しさん** · 2020/05/16(土) 20:04:12.78

訂正
試してなかった
^(.)\1*(?!\1)(.)(?:\1|\2)*(?!\1|\2)(.)(?:\1|\2|\3)*(?!\1|\2|\3)(.)(?:\1|\2|\3|\4)*

**デフォルトの名無しさん** · 2020/05/16(土) 20:19:48.01

無理だと思ったけどなんかできたわ
6種類以下の文字だけで行の頭から20文字
(?m:^)(?=(.)\1*+(?>(.)(?>\1|\2)*+(?>(.)(?>\1|\2|\3)*+(?>(.)(?>\1|\2|\3|\4)*+(?>(.)(?>\1|\2|\3|\4|\5)*+(.)?+)?+)?+)?+)?+)(?>\1|\2|\3|\4|\5|\6){20}

**デフォルトの名無しさん** · 2020/05/16(土) 20:35:19.65

>>203-205
ありがとうございます！
後方参照難しいですね…

**デフォルトの名無しさん** · 2020/05/16(土) 20:49:23.06

言ってる通りの条件でやると滅茶苦茶誤爆して使い物にならんと思う
例が7文字だし、ググって類似の荒らしが使っているものにマッチしつつ誤爆控え目にするように
110字以上のレスの最後まで7字以下というくらいの条件にしたらこんな感じか

^ *(?=.{110})([^ ])(?:[ ]|\1)*([^ ])(?:[ ]|\1|\2)*([^ ])(?:[ ]|\1|\2|\3)*([^ ])(?:[ ]|\1|\2|\3|\4)*
【改行】([^ ])(?:[ ]|\1|\2|\3|\4|\5)*([^ ])(?:[ ]|\1|\2|\3|\4|\5|\6)*([^ ])(?:[ ]|\1|\2|\3|\4|\5|\6|\7)*$

【改行】とその前の改行を削除

**デフォルトの名無しさん** · 2020/05/16(土) 21:09:00.00

別の判定要件にしないと誤爆頻発しそう...

例えば「特定コード範囲の文字が連続n回出現でNG」とかじゃダメなの?

**デフォルトの名無しさん** · 2020/05/16(土) 21:23:17.44

>>208
確率的に連続しないケースが結構出ちゃいますよね

**デフォルトの名無しさん** · 2020/05/17(日) 01:33:54.38

文字→文字または文字パターン、でどうだろう

そのボットの仕様を把握してないし実際のレスも見たことないのでなんとも言えないけど、文字種の制約以外に傾向を見いだせないってこと?

**デフォルトの名無しさん** · 2020/05/17(日) 03:28:48.68

>>210
こんな感じ

東大医学部医学科卒業、3年連続国試不合格のルシファーさん、偏差値95.3を取った模試の成績表をTwitterのヘッダーにしてしまう
http://leia.5ch.net/test/read.cgi/poverty/1589560323/

電光掲示板的なAAによって正規表現NGを逃れようとしている

今のところ
(\S{0,10}\s){10,}
(?=(.)\1*+(?>(.)(?>\1|\2)*+(?>(.)(?>\1|\2|\3)*+(?>(.)(?>\1|\2|\3|\4)*+(?>(.)(?>\1|\2|\3|\4|\5)*+(?>(.)(?>\1|\2|\3|\4|\5|\6)*+(?>(.)(?>\1|\2|\3|\4|\5|\6|\7)*+(?>(.)(?>\1|\2|\3|\4|\5|\6|\7|\8)*+(.)?+)?+)?+)?+)?+)?+)?+)?+)(?>\1|\2|\3|\4|\5|\6|\7|\8){17,}
で完璧に対応出来てる

**デフォルトの名無しさん** · 2020/05/17(日) 03:45:05.05

17文字もあるのに文字種が8種以内って
自然言語としては有り得ないわけですよ
そのエントロピー的な性質をターゲットにしてる
つまり完全ランダムじゃなくて電光掲示板的に嫌がらせメッセージを目立たせたいという意図を持ってるから可能になる手法

**デフォルトの名無しさん** · 2020/05/17(日) 03:46:57.41

>>211
なるほどw

**デフォルトの名無しさん** · 2020/05/17(日) 04:00:56.20

こうかはばつぐんだ！

必死にNG逃れのためのスクリプト書いたのに全て通用しなくて発狂して逃げたww

**デフォルトの名無しさん** · 2020/05/17(日) 04:36:26.20

結果として片棒担がされてた訳か

https://leia.5ch.net/test/read.cgi/poverty/1589560323/870
870 番組の途中ですがアフィサイトへの転載は禁止です (ﾜｯﾁｮｲW 2bde-sAUE) 2020/05/17(日) 00:30:59.00 ID:LtSh5oo60
再度書き込みなっちまったけど、レスすんなよ
グズ正規表現野郎。
お前が煽ったせいで、さらにサキオタアンチがめんどくさくなった。
皆、ひっそり、IDやﾜｯﾁｮｲと、少しの正規表現でNGしてた。
それらができない5chブラウザとかあるのに。

自分だけ調子に乗るなよクズ。

**デフォルトの名無しさん** · 2020/05/17(日) 04:41:56.29

>>215
それ荒らし本人が正規表現で完封されるのが悔しくて書いたやつだぞ

**デフォルトの名無しさん** · 2020/05/17(日) 04:45:15.72

そうなのか
でもはたから見てると一緒だと思うよ
荒らし構うのはただの荒らしだよ

**デフォルトの名無しさん** · 2020/05/17(日) 04:53:36.77

>>217
この荒らしは誰からも無視されてるのに何年も続けてる奴だからな
自分がターゲットにされて遊ばれて悔しいという体験は初めてだろうな
放置すれば荒らしが消えると思うのは間違い
キチガイは何年でも休まずに荒らし続ける
しかも手動で

そのキチガイの世界を壊してあげる作戦

**デフォルトの名無しさん** · 2020/05/17(日) 05:51:07.31

自粛警察みたいな奴だな
正義とか妄信しない方が良いぞ

**デフォルトの名無しさん** · 2020/05/17(日) 05:52:32.20

アホを悔しがらせて頭の体操になるなんて最高やん
こんな快感なこと他にある？

**デフォルトの名無しさん** · 2020/05/17(日) 13:46:59.90

正規表現を自動生成するAIはまだ?

**デフォルトの名無しさん** · 2020/05/17(日) 18:37:04.48

機械学習で正規表現を獲得するみたいなの出来ないですかね

**デフォルトの名無しさん** · 2020/05/17(日) 20:33:27.11

他力本願+ノイズは一人前

**デフォルトの名無しさん** · 2020/05/29(金) 08:30:19.28

*でも+でもどちらでもよいという場面では*にするのが慣例でしょうか？それとも文字通りどちらでもいいのかな？

**デフォルトの名無しさん** · 2020/05/29(金) 11:43:39.33

このスレに来る奴って論理的思考をする人達だと思ってたけど、
慣例とか持ち出すような奴も来るんだな
意味が有って違うSyntaxなんだから適切な方を使え

**デフォルトの名無しさん** · 2020/05/29(金) 12:20:15.31

どっちでもいいってどういう場合だ
どっちかになるだろ

**224** · 2020/05/29(金) 13:19:30.03

例えば対象が1回以上の繰り返しだとします
0回以上には1回以上が含まれているのだから、どちらかが適切であるという積極的な理由が見つかりません

**デフォルトの名無しさん** · 2020/05/29(金) 13:22:19.49

一つも無くていいってのと一つは必ず無いといけないってのは両立する場面は無い

**デフォルトの名無しさん** · 2020/05/29(金) 13:27:35.99

「1回以上」ならつべこべ言わずに"+"だな
「0回は外したい」という意味を含むのであれば
"*"は仕様から外れる
個人的には"*"はできるだけ使わない

**デフォルトの名無しさん** · 2020/05/29(金) 15:05:09.67

1回以上であることが分かっているのであれば0回の可能性がないことを示しておけるというのが合理的理由だよ。
*でマッチさせられるとしても後からソース見て混乱するだけだ。慣例といえば慣例だが機能すればいいというものでもない。

**デフォルトの名無しさん** · 2020/05/29(金) 19:24:39.89

>>227
読む人(未来の自分含む)のことを考えれば、可能な限り対象を絞り込んだ方が(設計意図が読み取りやすくて)よい

**デフォルトの名無しさん** · 2020/05/29(金) 21:22:17.43

A+とAA*の効率化の話かと思った
AA*の方が最初のAで最適化される分だけ速いとかなんとか

**デフォルトの名無しさん** · 2020/05/29(金) 21:49:09.90

>>232
オートマトンを組むので速度は変わらないと思うが

**デフォルトの名無しさん** · 2020/06/18(木) 21:13:18.22

https://i.imgur.com/ngqWoOX.jpg

上を下としたいのですが、２回に分けることは可能ですが、１回でやれますでしょうか？スラッシュが含まれる場合、そこをエスケープしたいのです
scriptタグ貼ると怒られますので、画像です(´・ω・`)、、、

**デフォルトの名無しさん** · 2020/06/18(木) 22:17:30.24

>>234
正規表現：　(<([^>]+)>[^<]*<)(/\2>)
置換　　　：　"$1\$3"

**デフォルトの名無しさん** · 2020/06/18(木) 22:21:10.54

環境によっては
置換：　"$1\\$3"
としないとダメなこともあり

**デフォルトの名無しさん** · 2020/06/18(木) 22:28:45.36

>>235 は.NET
>>236 はperl

sed だと
置換：　"\1\\\3"

**デフォルトの名無しさん** · 2020/06/18(木) 22:37:34.06

<スクリプト>(ここが変化)</スクリプト>
って感じでスクリプトとスクリプトの間が変化するだけじゃない？