python - Pythonで文字列の出現をカウントする方法

Question

私はこのファイルを持っています

10, 44.66.44.55 , AD, AC , 112
10, 44.66.54.55 , AD, AC , 112
10, 44.66.44.55 , AD, AC , 112
50, 44.66.64.55 , AD, AC , 112
10, 44.66.54.55 , AD, AC , 112
10, 44.66.44.55 , AD, AC , 112

同じIPアドレスでcolumn1を追加したい。次のような出力が必要です

30, 44.66.44.55 , AD, AC , 112
20, 44.66.54.55 , AD, AC , 112
50, 44.66.64.55 , AD, AC , 112

Pythonでやりたい

私は試した

import re
import collections

a = collections.Counter()
with open("temp.txt", "r") as f:
   for line in f.readlines():
         list = line.split()
     a[list[1]] += int(list[0])
         print list[1]

score 1 · Accepted Answer

この場合に理想的な itertools.groupby ソリューションを使用できます。

>>> with open("test.csv") as fin:
    grouped_lines = groupby(sorted((e.split(',') for e in fin), key = itemgetter(1)), key = itemgetter(1))


>>> for k, v in grouped_lines:
    lines = list(v)
    lines[0][0] = sum(int(e[0]) for e in lines)
    print lines[0]


[30, ' 44.66.44.55 ', ' AD', ' AC ', ' 112\n']
[20, ' 44.66.54.55 ', ' AD', ' AC ', ' 112\n']
[50, ' 44.66.64.55 ', ' AD', ' AC ', ' 112\n']

score 1 · Accepted Answer

1

,空白ではなく分割する必要があります

これを試して

list = line.split(',')

于 2013-01-30T03:47:53.123 に答える

score 0 · Accepted Answer

@Abhijitの答えは短いですが、
これを試してみてください。

ファイルデータを処理した後、データをディクショナリに格納します。このデータは、必要に応じて操作されます。
あなたのデータは辞書の値です。

all_ips = {}

f = open('Test2.txt')
lines = f.readlines()
f.close()

for line in lines:
    ip = line.split(',')[1]

    props = line.split(',')
    props[0] = int(props[0])

    if ip not in all_ips:
        all_ips[ip] = props
    else:
        all_ips[ip][0] += props[0]

for ip in all_ips:
    print all_ips[ip]

score 0 · Accepted Answer

モジュールがありcollections.Counterます。http://docs.python.org/2/library/collections.htmlの辞書を返します{'word': numberTimes}

python - Pythonで文字列の出現をカウントする方法

4 に答える 4

Related

Reference