From: KIMURA Koichi Date: 2008-01-09T02:06:18+09:00 Subject: [ruby-dev:32989] Re: BOM of UTF-8 木村です。 まつもとさん、成瀬さん回答ありがとうございます。 方針は了解しました。 Yukihiro Matsumoto さんは書きました (2008/01/07 23:55): > |のように処理しようとしたときに、ファイル先頭の行についてBOMの > |扱いはユーザーがよろしくやれという方針かどうかということです。 > > そういうことですね。あるいはBOM awareなopenを提供するライブ > ラリが登場するかもしれませんが。 なるほど。了解です。 > |#某gawkで、BOMつきUTF-8テキスト(メモ帳で作るともれなくBOMつきになります) > |#を食わせていて、「スクリプトが期待通り動きません。バグですか」 > |#という問い合わせをいただいたことがありましてちょっと気になってます > > 「メモ帳のバグです」と言いたいところですね。言いませんが。 メモ帳のバグとは言いませんでしたが、BOMつけないエディタでテキストを 作ってくれということで納得してもらいました。 NARUSE, Yui さんは書きました (2008/01/08 0:02): > 仕様の話を出しておくと、UTF-8 は RFC 3629 なんですが、6. Byte order > mark (BOM) で勝手に BOM を捨てちゃうのはまずいかも、といったようなことが > 書いてあります。 > “RECOMMENDED to avoid stripping an initial U+FEFF” > http://www.ietf.org/rfc/rfc3629.txt > > もっとも、nkf では ZERO WIDTH NO-BREAK SPACE なんか使ってる人間いねー > よ、ってことで捨てちゃってますけど。 はい。色々事情があって、BOMいらねーで読み飛ばすのも問題ないわけではない というのは xgawkの開発者連も言ってました。自分としては方針が明確に なっていてwork around が提示できればいいと思ってましたので今回の回答で 不満はありません。 -- 木村浩一 I thought what I'd do was, I'd pretend I was one of those deaf-mutes or should I? mail kbk at kt.rim.or.jp web www.kt.rim.or.jp/~kbk/zakkicho/ homepage3.nifty.com/farstar/