質問をすることでしか得られない、回答やアドバイスがある。

15分調べてもわからないことは、質問しよう!

新規登録して質問してみよう
ただいま回答率
87.20%
for

for文は、様々なプログラミング言語で使われている制御構造です。for文に定義している条件から外れるまで、for文内の命令文を繰り返し実行します。

if

if文とは様々なプログラミング言語で使用される制御構文の一種であり、条件によって処理の流れを制御します。

Python

Pythonは、コードの読みやすさが特徴的なプログラミング言語の1つです。 強い型付け、動的型付けに対応しており、後方互換性がないバージョン2系とバージョン3系が使用されています。 商用製品の開発にも無料で使用でき、OSだけでなく仮想環境にも対応。Unicodeによる文字列操作をサポートしているため、日本語処理も標準で可能です。

pandas

Pandasは、PythonでRにおけるデータフレームに似た型を持たせることができるライブラリです。 行列計算の負担が大幅に軽減されるため、Rで行っていた集計作業をPythonでも比較的簡単に行えます。 データ構造を変更したりデータ分析したりするときにも便利です。

解決済

Pandasで、文字列が混在したデータフレームを数値化する方法を教えて頂けませんか

YOSHITAKEH
YOSHITAKEH

総合スコア0

for

for文は、様々なプログラミング言語で使われている制御構造です。for文に定義している条件から外れるまで、for文内の命令文を繰り返し実行します。

if

if文とは様々なプログラミング言語で使用される制御構文の一種であり、条件によって処理の流れを制御します。

Python

Pythonは、コードの読みやすさが特徴的なプログラミング言語の1つです。 強い型付け、動的型付けに対応しており、後方互換性がないバージョン2系とバージョン3系が使用されています。 商用製品の開発にも無料で使用でき、OSだけでなく仮想環境にも対応。Unicodeによる文字列操作をサポートしているため、日本語処理も標準で可能です。

pandas

Pandasは、PythonでRにおけるデータフレームに似た型を持たせることができるライブラリです。 行列計算の負担が大幅に軽減されるため、Rで行っていた集計作業をPythonでも比較的簡単に行えます。 データ構造を変更したりデータ分析したりするときにも便利です。

1回答

0評価

1クリップ

9689閲覧

投稿2018/11/24 18:16

編集2022/01/12 10:58

Pandasのデータテーブルに、文字列が混ざっています。数値(整数:int)にする方法がうまくいきません。アドバイスを頂けますでしょうか。

やりたいこと

以下のdataflame(以下、df)に対して、

dateitemsales
2018-1-1トマト983220
2018-1-1りんご233320
2018-1-2みかん29.1万円
2018-1-3トマト1983220
2018-1-4りんご1233320
2018-1-5ぶどう19.1万円

sales列の中から、万円の文字を削除し、さらに1000倍して桁数をあわせ、全て整数(int型)に統一したいです。

試したこと

まず、考えたのは、

  • 万円を replace関数で削除する
  • 1000倍する(float()と、*1000)
  • 数値(整数)にする(int())

そして、これをfor文で繰り返す。

ということです。私が考えたのは、以下のようなコードです。

python

for i in range(1,len(df['sales'])): if "万" not in df.loc[i,'sales']: df.loc[i,'sales'] = int(df.loc[i,'sales']) else: df.loc[i,'sales'] = int(float(df.loc[i,'sales'].replace('万',''))*1000)

教えて頂きたいこと

1.FOR文、IF文の書き方の誤りについて

上記のコードのうち、最下部の

python

int(float(df.loc[i,'sales'].replace('万',''))*1000)

をfor文、及びif文を使わずに、1つのセルだけ置換、1000倍、型変換をすると、求める数値が算出できます。しかし、for文やif文を使うとエラーがでてしまいます。for文、if文の誤りをご指摘いただけないでしょうか。

1.FOR文、IF文を使わないスマートな方法を教えていただけませんでしょうか。

いろいろ調べていると、map関数、Lambda式など、もう少しスマートな方法があるようなことを知りました。わたしのやりたいことに照らし合わせると、FOR文やIF文は、相応しくないのでしょうか?アドバイスいただけると幸いです。

環境

Macbook pro
Anaconda
Python 3.6
Jupyter notebook
panas

お忙しいとは思いますが、よろしくお願いいたします。
情報に不足がありましたら、ご指摘くださいませ。

良い質問の評価を上げる

以下のような質問は評価を上げましょう

  • 質問内容が明確
  • 自分も答えを知りたい
  • 質問者以外のユーザにも役立つ

評価が高い質問は、TOPページの「注目」タブのフィードに表示されやすくなります。

気になる質問をクリップする

クリップした質問は、後からいつでもマイページで確認できます。

またクリップした質問に回答があった際、通知やメールを受け取ることができます。

teratailでは下記のような質問を「具体的に困っていることがない質問」、「サイトポリシーに違反する質問」と定義し、推奨していません。

  • プログラミングに関係のない質問
  • やってほしいことだけを記載した丸投げの質問
  • 問題・課題が含まれていない質問
  • 意図的に内容が抹消された質問
  • 過去に投稿した質問と同じ内容の質問
  • 広告と受け取られるような投稿

評価を下げると、トップページの「アクティブ」「注目」タブのフィードに表示されにくくなります。

まだ回答がついていません

会員登録して回答してみよう

15分調べてもわからないことは
teratailで質問しよう!

ただいまの回答率
87.20%

質問をまとめることで
思考を整理して素早く解決

テンプレート機能で
簡単に質問をまとめる

質問する

関連した質問

同じタグがついた質問を見る

for

for文は、様々なプログラミング言語で使われている制御構造です。for文に定義している条件から外れるまで、for文内の命令文を繰り返し実行します。

if

if文とは様々なプログラミング言語で使用される制御構文の一種であり、条件によって処理の流れを制御します。

Python

Pythonは、コードの読みやすさが特徴的なプログラミング言語の1つです。 強い型付け、動的型付けに対応しており、後方互換性がないバージョン2系とバージョン3系が使用されています。 商用製品の開発にも無料で使用でき、OSだけでなく仮想環境にも対応。Unicodeによる文字列操作をサポートしているため、日本語処理も標準で可能です。

pandas

Pandasは、PythonでRにおけるデータフレームに似た型を持たせることができるライブラリです。 行列計算の負担が大幅に軽減されるため、Rで行っていた集計作業をPythonでも比較的簡単に行えます。 データ構造を変更したりデータ分析したりするときにも便利です。