如果我有一个这样的表格:
df = pd.DataFrame({
'hID': [101, 102, 103, 101, 102, 104, 105, 101],
'dID': [10, 11, 12, 10, 11, 10, 12, 10],
'uID': ['James', 'Henry', 'Abe', 'James', 'Henry', 'Brian', 'Claude', 'James'],
'mID': ['A', 'B', 'A', 'B', 'A', 'A', 'A', 'C']
})
我可以在Qlik中做count(distinct hID)
来为唯一的hID计算5。我如何在python中使用熊猫数据框架做到这一点?或者是numpy数组?类似地,如果要执行count(hID)
,我将在Qlik中获得8。对熊猫来说,同样的方法是什么?