Windows NTは初代からUnicodeがネイティブの文字コードです。cp932ではありません。
プログラマーなら一度は煩わされたことのある文字コードについてのスレ。
UTF-8、Shift_JIS、JIS、EUC、Unicode、UCS、サロゲートペア、コードポイント、文字コード判定、
合成文字、ソート、TRON、外字コード、その他について語り合いましょう。
各言語での文字列の扱いについての質問もOKです。
基本マッターリ、ささ、茶でもどうぞ。
■過去スレ
文字コード総合スレ part1 http://pc11.2ch.net/test/read.cgi/tech/1031028205/
文字コード総合スレ part2 http://pc11.2ch.net/test/read.cgi/tech/1143375639/
文字コード総合スレ part3 http://pc11.2ch.net/test/read.cgi/tech/1180250376/
文字コード総合スレ part4 http://pc11.2ch.net/test/read.cgi/tech/1228052369/
(スレ再利用)UnicodeとUTF-8の違いは? http://pc12.2ch.net/test/read.cgi/tech/1177930957/
(隔離スレ)UnicodeとUTF-8の違いは? その2 http://pc12.2ch.net/test/read.cgi/tech/1274937437/
文字コード総合スレ part5 http://pc12.2ch.net/test/read.cgi/tech/1236529563/
文字コード総合スレ part6 http://hibari.2ch.net/test/read.cgi/tech/1278923059/
文字コード総合スレ part7 http://toro.2ch.net/test/read.cgi/tech/1306595564/
文字コード総合スレ part8 http://peace.2ch.net/test/read.cgi/tech/1354248962/
文字コード総合スレ part9 http://peace.2ch.net/test/read.cgi/tech/1401301779/
文字コード総合スレ Part10 http://mevius.2ch.net/test/read.cgi/tech/1444822140/
文字コード総合スレ Part11 https://mevius.5ch.net/test/read.cgi/tech/1516629503/
文字コード総合スレ Part12 https://mevius.5ch.net/test/read.cgi/tech/1544931495/
探検
文字コード総合スレ part13
レス数が1000を超えています。これ以上書き込みはできません。
1デフォルトの名無しさん
2020/07/03(金) 20:53:47.08ID:elbfDzqw968デフォルトの名無しさん
2023/03/02(木) 13:08:38.21ID:i0CU6OJ9 いや、そこまでしてBOMを避ける理由がわからん
BOMでなければなんでもいいのかよw
BOMでなければなんでもいいのかよw
969デフォルトの名無しさん
2023/03/02(木) 13:36:36.77ID:SYo8L+Nt >>968
好きな理由1つ選んで
・UTF-8の最大の特徴はASCIIと上位互換、BOMをつけたら台無しになる
・今はUTF-8 はBOM無しが主流
・将来の外部コードはUTF-8のBOM無しになることがほぼ確定している
・移行期だけのために余計なものをつけたくない
・BOMつきだと動かないシステムがある
・文字コードの自動判定はバグやセキュリホールの温床になるので削除したい
・SJISとか時代遅れのものはもう使用してない
・BOMの曖昧さはセキュリティホールになる可能性がある
・ZWNBS との曖昧さがいやらしい
・規格で非推奨のものは避けたい
・ファイルの接続とか分割やファイル名操作などに曖昧さがあるのはいや
・不要なものを付ける理由が思いつかない
・とにかく嫌い
他にも理由はあるだろうけど、人それぞれ
好きな理由1つ選んで
・UTF-8の最大の特徴はASCIIと上位互換、BOMをつけたら台無しになる
・今はUTF-8 はBOM無しが主流
・将来の外部コードはUTF-8のBOM無しになることがほぼ確定している
・移行期だけのために余計なものをつけたくない
・BOMつきだと動かないシステムがある
・文字コードの自動判定はバグやセキュリホールの温床になるので削除したい
・SJISとか時代遅れのものはもう使用してない
・BOMの曖昧さはセキュリティホールになる可能性がある
・ZWNBS との曖昧さがいやらしい
・規格で非推奨のものは避けたい
・ファイルの接続とか分割やファイル名操作などに曖昧さがあるのはいや
・不要なものを付ける理由が思いつかない
・とにかく嫌い
他にも理由はあるだろうけど、人それぞれ
970デフォルトの名無しさん
2023/03/02(木) 13:36:59.98ID:QpnfRCZF BOMを付けておくと都合がいいケースがたまたまあっただけ
971デフォルトの名無しさん
2023/03/02(木) 15:35:38.23ID:j9aKoD1k ・移行期だからこそBOMで他のエンコーディングと区別できるようにしておきたい場合がある
・BOMなしだと動かないシステムがある
・文字コードの自動判定はバグやセキュリホールの温床になるのでBOMを付けておきたい
・SJISはJIS X 0208で標準化されている現役の規格
・今のUnicodeの規格ではZWNBSP(U+FEFF)ではなくWORD JOINER(U+2060)の使用が強く推奨されているのでBOMとの曖昧性は起きない
・規格で許可されてるものを無理に避ける必要はない
・許可されているものを避ける理由が思いつかない
・BOMなしだと動かないシステムがある
・文字コードの自動判定はバグやセキュリホールの温床になるのでBOMを付けておきたい
・SJISはJIS X 0208で標準化されている現役の規格
・今のUnicodeの規格ではZWNBSP(U+FEFF)ではなくWORD JOINER(U+2060)の使用が強く推奨されているのでBOMとの曖昧性は起きない
・規格で許可されてるものを無理に避ける必要はない
・許可されているものを避ける理由が思いつかない
972デフォルトの名無しさん
2023/03/02(木) 15:58:33.33ID:0lgr0WAt すべてはカネ次第。カネを出す人が決めればいいだけ。つまり経営マターってこと。
973デフォルトの名無しさん
2023/03/02(木) 16:21:08.46ID:H1OYjGZw > ・文字コードの自動判定はバグやセキュリホールの温床になるのでBOMを付けておきたい
BOM付けてリスク変わる?
BOM付けてリスク変わる?
974デフォルトの名無しさん
2023/03/02(木) 17:03:17.28ID:i0CU6OJ9 そりゃ変わるだろ、BOMが付いてれば判定ミスがなくなる
975デフォルトの名無しさん
2023/03/02(木) 17:19:23.19ID:H1OYjGZw BOM見てUTF-8だってのは自動判定の一要素でしかないしBOMなし対応いらなくなるわけじゃないから変わらないと思うんだけどな
ユーザー視点の話なら一つ前のと同じこと言ってるわけだし
ユーザー視点の話なら一つ前のと同じこと言ってるわけだし
976デフォルトの名無しさん
2023/03/02(木) 17:51:26.36ID:0lgr0WAt >>975
ゴールポストを動かすように自動判定の定義を動かすのはみっともないからやめとけ
ゴールポストを動かすように自動判定の定義を動かすのはみっともないからやめとけ
977デフォルトの名無しさん
2023/03/02(木) 18:28:28.35ID:l6zpHt6k978デフォルトの名無しさん
2023/03/02(木) 18:43:46.01ID:SYo8L+Nt >>977
自動判定のセキュリティ・リスクはそういうところじゃないよ。認識率100%でも起こる、むしろそっちが攻撃に使い易い。セキュリティまわりは勉強したことない素人が思いつくほど単純じゃない。
自動判定のセキュリティ・リスクはそういうところじゃないよ。認識率100%でも起こる、むしろそっちが攻撃に使い易い。セキュリティまわりは勉強したことない素人が思いつくほど単純じゃない。
979デフォルトの名無しさん
2023/03/02(木) 19:12:41.37ID:/D1s32sE980デフォルトの名無しさん
2023/03/02(木) 19:16:14.91ID:l6zpHt6k >>978
つまり世の中のテキストエディタからEUC-JP対応を削除しろって話をしてるの?
つまり世の中のテキストエディタからEUC-JP対応を削除しろって話をしてるの?
981デフォルトの名無しさん
2023/03/02(木) 19:30:13.68ID:H1OYjGZw 仕様で文字コードが固定されていようがBOMで判断しようが
不正データを読んで変なことにならないようにすることと全く関係ないだろ
もしかして「文字コードの自動判定」という機能単体の話でBOMチェックだけならば堅牢だって趣旨だったのか
不正データを読んで変なことにならないようにすることと全く関係ないだろ
もしかして「文字コードの自動判定」という機能単体の話でBOMチェックだけならば堅牢だって趣旨だったのか
982デフォルトの名無しさん
2023/03/02(木) 20:53:06.62ID:YeVHKr55 「文字コードの自動判定にはセキュリティリスクがある」
↓
BOMによる判定も自動判定だ
↓
だからBOMにセキュリティリスクがある
なにこの三段論法w
↓
BOMによる判定も自動判定だ
↓
だからBOMにセキュリティリスクがある
なにこの三段論法w
983デフォルトの名無しさん
2023/03/02(木) 21:03:19.85ID:4xkEbAJQ そんなこと言ってんのお前だけやで
984デフォルトの名無しさん
2023/03/02(木) 21:44:42.19ID:H1OYjGZw985蟻人間 ◆T6xkBnTXz7B0
2023/03/02(木) 21:56:36.58ID:ymadH6pR https://github.com/reactos/reactos/blob/6d57c6c91cdf2854b73b9696cd45f41322449368/base/applications/notepad/text.c#L40
ちなみにReactOSのメモ帳の文字セット判定はこうなっている。
ちなみにReactOSのメモ帳の文字セット判定はこうなっている。
986デフォルトの名無しさん
2023/03/03(金) 00:03:50.07ID:GXuOSZhF >>984
すげー単純な例だとバイナリファイルの先頭に UTF-8 BOM つけてテキストに偽装、ファイアウォールやウィルスチェックをすり抜ける。うかつなソフトが自動判別してBOMを外して次段に渡してマルウェア発動。
アホみたいだがこんなんで実際に被害が出てるんだぜ。実際はこんな単純じゃなくてもっと複雑で発見され難い攻撃ができる。
すげー単純な例だとバイナリファイルの先頭に UTF-8 BOM つけてテキストに偽装、ファイアウォールやウィルスチェックをすり抜ける。うかつなソフトが自動判別してBOMを外して次段に渡してマルウェア発動。
アホみたいだがこんなんで実際に被害が出てるんだぜ。実際はこんな単純じゃなくてもっと複雑で発見され難い攻撃ができる。
987デフォルトの名無しさん
2023/03/03(金) 01:54:41.66ID:BY62yhT8 >>971
ZWNBS についてだが uniccode standard には
「BOMが不要な場合には先頭の U+FEFF は後方互換性のために ZWNBS と解釈される」という規定がある。
これと「UTF-8 に BOM は不要」という規定を合わせると...入力処理系の実装はどうなる? 曖昧さがあるだろ。
ZWNBS についてだが uniccode standard には
「BOMが不要な場合には先頭の U+FEFF は後方互換性のために ZWNBS と解釈される」という規定がある。
これと「UTF-8 に BOM は不要」という規定を合わせると...入力処理系の実装はどうなる? 曖昧さがあるだろ。
988デフォルトの名無しさん
2023/03/03(金) 02:53:30.47ID:NQKxEL/3989デフォルトの名無しさん
2023/03/03(金) 02:55:06.26ID:NQKxEL/3990デフォルトの名無しさん
2023/03/03(金) 05:11:52.34ID:Utd2ywhQ バイナリとして扱ったとしてもデータとして使うのか?
それとも実行可能ファイルとして使うのか?
後者はもう BOMの使い方を大きく離脱しているな
それとも実行可能ファイルとして使うのか?
後者はもう BOMの使い方を大きく離脱しているな
991デフォルトの名無しさん
2023/03/03(金) 09:15:08.54ID:oC7cFOXy I hate Windows.
992デフォルトの名無しさん
2023/03/03(金) 09:18:38.82ID:oC7cFOXy993デフォルトの名無しさん
2023/03/03(金) 09:24:55.04ID:oC7cFOXy >>980
ついでにSJIS対応もISO2022JP対応も削除で
ついでにSJIS対応もISO2022JP対応も削除で
994デフォルトの名無しさん
2023/03/03(金) 09:26:04.28ID:oC7cFOXy >>982 が稀に観る白雉
995デフォルトの名無しさん
2023/03/03(金) 11:30:01.20ID:I6sfeYN1 誰だシェルスクリプトをBOM付きで編集したのは!
996デフォルトの名無しさん
2023/03/03(金) 11:33:14.61ID:NQKxEL/3 お前だろ
ってかBOMは許可されてるのに
そういう例外を持ってきてわーわー騒ごうとするのは頭が悪い
ってかBOMは許可されてるのに
そういう例外を持ってきてわーわー騒ごうとするのは頭が悪い
997デフォルトの名無しさん
2023/03/03(金) 12:02:55.61ID:oC7cFOXy シェルスクリプトが万が一BOM付きshebangを解釈するようになったとしても
catはどう処理されるんだろ
面倒だから止めてるんだろうな
catはどう処理されるんだろ
面倒だから止めてるんだろうな
998デフォルトの名無しさん
2023/03/03(金) 12:46:30.84ID:NnDpncr7 昔のmsysのcat.exeは0x0Aを勝手に0x0D0x0Aに変換して出力する仕様だったので、人知れず泣いた人多かったんじゃないかと思う
>>997
BOMをスキップするオプションとか追加すれば対処できるんじゃまいか
>>997
BOMをスキップするオプションとか追加すれば対処できるんじゃまいか
999デフォルトの名無しさん
2023/03/03(金) 12:50:33.85ID:oC7cFOXy binaryオプション付けなければwin上で0d0aにされても文句言えない罠
しかしデフォでbom無であるべきで
デフォがbom付になるのは許すまじ
しかしデフォでbom無であるべきで
デフォがbom付になるのは許すまじ
1000デフォルトの名無しさん
2023/03/03(金) 12:50:48.52ID:oC7cFOXy EOF
10011001
Over 1000Thread このスレッドは1000を超えました。
新しいスレッドを立ててください。
life time: 972日 15時間 57分 1秒
新しいスレッドを立ててください。
life time: 972日 15時間 57分 1秒
レス数が1000を超えています。これ以上書き込みはできません。
ニュース
- 【サッカー】J2第38節 水戸がJ2初優勝!長崎は2位でJ1自動昇格!千葉は大量得点もPOへ [久太郎★]
- 「特に中国は事態悪化を控えるべき」 日中対立巡りフランス高官言及 ★2 [蚤の市★]
- アミューズが同性婚訴訟への声明を発表「誰もが良く生きられる自由」を目指す、東京高裁の判決を受け [muffin★]
- 【公明党】派遣型風俗店の女性の裸をスマホで盗撮か 徳島県議会議員の古川広志容疑者逮捕 警視庁 [nita★]
- 橋下徹氏 高市首相“台湾有事”発言に「政治家の失言で一部の人でも仕事がキャンセルに…我々は認めていいのかな」疑問呈す★2 [muffin★]
- 【イオン】中国湖南省に新大型店を開業 混乱なく地元客でにぎわい モール内にユニクロや無印良品★2 [1ゲットロボ★]
- 他サポ2025-275
- 他サポ2025-276
- ジュビロ磐田を応援するにぃ~ vs 鳥栖 part2
- ジェフユナイテッド千葉実況 vs 今治
- 【なでしこ】女子サッカーMS&ADカップ2025 日本vsカナダ
- 東京競馬
- 鈴木農相「お米券でパスタやお菓子も買えるようにします☺」・・・???😰 [931948549]
- (ヽ´😷`)⇐鼻だしマスクしてるおじさんいるでしょ [904880432]
- 【速報】壱百満天原サロメさん、大炎上
- ふなっしょい🍬なのらああああああwww🏡
- おちんちんきもちいいお(´;ω;`)
- 余る新米「国が買い取って」卸売業者ら [177178129]
