質問をすることでしか得られない、回答やアドバイスがある。

15分調べてもわからないことは、質問しよう!

新規登録して質問してみよう
ただいま回答率
85.46%
Python

Pythonは、コードの読みやすさが特徴的なプログラミング言語の1つです。 強い型付け、動的型付けに対応しており、後方互換性がないバージョン2系とバージョン3系が使用されています。 商用製品の開発にも無料で使用でき、OSだけでなく仮想環境にも対応。Unicodeによる文字列操作をサポートしているため、日本語処理も標準で可能です。

Q&A

解決済

3回答

1654閲覧

Python Pythonファイル(utf-8) から windowsテキストファイル(cp932)への書き出しができない

ngh_orange

総合スコア17

Python

Pythonは、コードの読みやすさが特徴的なプログラミング言語の1つです。 強い型付け、動的型付けに対応しており、後方互換性がないバージョン2系とバージョン3系が使用されています。 商用製品の開発にも無料で使用でき、OSだけでなく仮想環境にも対応。Unicodeによる文字列操作をサポートしているため、日本語処理も標準で可能です。

0グッド

0クリップ

投稿2021/05/07 10:06

前提・実現したいこと

Pythonで作成したファイルのフルパスをテキストファイルに出力したいです

出力する情報は、別の処理で作成したファイルのフルパスです。
出力されたテキストファイルの情報をそのままバッチファイルに渡して使いたいです。
なので、結合文字だと元の作成されたファイルの名前と違ってしまい動かないので困っています

発生している問題・エラーメッセージ

下記のエラーのようにでます

UnicodeEncodeError: 'cp932' codec can't encode character '\u3099' in position 41: illegal multibyte sequence

・\u3099は濁点の文字
・utf-8だと結合文字というのがあり、それでもルール上OKだということ
この2つは理解できましたが、それをどう治せば良いのかがわかりません

試したこと

open関数にencodingのオプションを元々つけていなかったのですが
試しにつけてみると、テキストファイルに出力はできるのですが結合文字になってしまいます

Python

1txt = open("data.txt", mode='w',encoding="utf-8") 2 txt.write("{0}".format(mozi)) 3 txt.close()

補足情報(FW/ツールのバージョンなど)

Windows 10
Python 3

自分でもまとまってなく質問が分かりづらかったら申し訳ありません
テキストファイルに出力される文字を「か+゛」ではなく「が」のように出力したいということです

気になる質問をクリップする

クリップした質問は、後からいつでもMYページで確認できます。

またクリップした質問に回答があった際、通知やメールを受け取ることができます。

バッドをするには、ログインかつ

こちらの条件を満たす必要があります。

guest

回答3

0

出力する情報は、別の処理で作成したファイルのフルパスです。

ということなら、ファイルのフルパスを作成するときに濁点文字を使わないようにした方が簡単なのではないでしょうか。

投稿2021/05/07 10:53

ppaul

総合スコア24666

バッドをするには、ログインかつ

こちらの条件を満たす必要があります。

ngh_orange

2021/05/07 11:26

いつも回答ありがとうございます その発想はありませんでした! 下の「otn」さんの処理と組み合わせることでやりたい処理ができました、ありがとうございます!
guest

0

ベストアンサー

unicodedata.normalizeで、「か」+「濁音記号」を「が」に出来ます。

Pythom

1import unicodedata 2 3ketsugou_go = unicodedata.normalize("NFC", ketsuzou_mae)

投稿2021/05/07 10:43

otn

総合スコア84798

バッドをするには、ログインかつ

こちらの条件を満たす必要があります。

ngh_orange

2021/05/07 11:25

回答ありがとうございます そんな方法があったんですね!知らなかったです! この処理と上の「ppaul」さんを組み合わせることでやりたい処理ができました!
guest

0

encoding="utf-8"だと、UTF8としてオープンするってことなので、ここは"shift_jis"にしてはどうでしょう

投稿2021/05/07 10:28

y_waiwai

総合スコア87800

バッドをするには、ログインかつ

こちらの条件を満たす必要があります。

ngh_orange

2021/05/07 10:35

回答ありがとうございます! UnicodeEncodeError: 'shift_jis' codec can't encode character '\u3099' in position 41: illegal multibyte sequence というエラーがでてしまい、同じような結果になってしまいました....
guest

あなたの回答

tips

太字

斜体

打ち消し線

見出し

引用テキストの挿入

コードの挿入

リンクの挿入

リストの挿入

番号リストの挿入

表の挿入

水平線の挿入

プレビュー

15分調べてもわからないことは
teratailで質問しよう!

ただいまの回答率
85.46%

質問をまとめることで
思考を整理して素早く解決

テンプレート機能で
簡単に質問をまとめる

質問する

関連した質問