色综合图-色综合图片-色综合图片二区150p-色综合图区-玖玖国产精品视频-玖玖香蕉视频

您的位置:首頁技術文章
文章詳情頁

Python 數據的累加與統計的示例代碼

瀏覽:20日期:2022-07-15 11:55:35

問題

你需要處理一個很大的數據集并需要計算數據總和或其他統計量。

解決方案

對于任何涉及到統計、時間序列以及其他相關技術的數據分析問題,都可以考慮使用 Pandas庫 。

為了讓你先體驗下,下面是一個使用Pandas來分析芝加哥城市的 老鼠和嚙齒類動物數據庫 的例子。 在我寫這篇文章的時候,這個數據庫是一個擁有大概74,000行數據的CSV文件。

>>> import pandas>>> # Read a CSV file, skipping last line>>> rats = pandas.read_csv(’rats.csv’, skip_footer=1)>>> rats<class ’pandas.core.frame.DataFrame’>Int64Index: 74055 entries, 0 to 74054Data columns:Creation Date 74055 non-null valuesStatus 74055 non-null valuesCompletion Date 72154 non-null valuesService Request Number 74055 non-null valuesType of Service Request 74055 non-null valuesNumber of Premises Baited 65804 non-null valuesNumber of Premises with Garbage 65600 non-null valuesNumber of Premises with Rats 65752 non-null valuesCurrent Activity 66041 non-null valuesMost Recent Action 66023 non-null valuesStreet Address 74055 non-null valuesZIP Code 73584 non-null valuesX Coordinate 74043 non-null valuesY Coordinate 74043 non-null valuesWard 74044 non-null valuesPolice District 74044 non-null valuesCommunity Area 74044 non-null valuesLatitude 74043 non-null valuesLongitude 74043 non-null valuesLocation 74043 non-null valuesdtypes: float64(11), object(9)>>> # Investigate range of values for a certain field>>> rats[’Current Activity’].unique()array([nan, Dispatch Crew, Request Sanitation Inspector], dtype=object)>>> # Filter the data>>> crew_dispatched = rats[rats[’Current Activity’] == ’Dispatch Crew’]>>> len(crew_dispatched)65676>>>>>> # Find 10 most rat-infested ZIP codes in Chicago>>> crew_dispatched[’ZIP Code’].value_counts()[:10]60647 383760618 353060614 328460629 325160636 280160657 246560641 223860609 220660651 215260632 2071>>>>>> # Group by completion date>>> dates = crew_dispatched.groupby(’Completion Date’)<pandas.core.groupby.DataFrameGroupBy object at 0x10d0a2a10>>>> len(dates)472>>>>>> # Determine counts on each day>>> date_counts = dates.size()>>> date_counts[0:10]Completion Date01/03/2011 401/03/2012 12501/04/2011 5401/04/2012 3801/05/2011 7801/05/2012 10001/06/2011 10001/06/2012 5801/07/2011 101/09/2012 12>>>>>> # Sort the counts>>> date_counts.sort()>>> date_counts[-10:]Completion Date10/12/2012 31310/21/2011 31409/20/2011 31610/26/2011 31902/22/2011 32510/26/2012 33303/17/2011 33610/13/2011 37810/14/2011 39110/07/2011 457>>>

嗯,看樣子2011年10月7日對老鼠們來說是個很忙碌的日子啊!^_^

討論

Pandas是一個擁有很多特性的大型函數庫,我在這里不可能介紹完。 但是只要你需要去分析大型數據集合、對數據分組、計算各種統計量或其他類似任務的話,這個函數庫真的值得你去看一看。

以上就是Python 數據的累加與統計的方法的詳細內容,更多關于Python 數據的累加與統計的資料請關注好吧啦網其它相關文章!

標簽: Python 編程
相關文章:
主站蜘蛛池模板: 成人免费视频一区二区 | 免费观看一级成人毛片软件 | 国产精品亚洲第一区二区三区 | 一级特级欧美a毛片免费 | 欧美另类videosgrstv变态 欧美另类高清xxxxx | 亚洲精品一区二区三区第四页 | 一区二区三区免费精品视频 | 成人免费视频一区二区三区 | 免费看男女做好爽好硬视频 | 九九99re在线视频精品免费 | 国产在线观看免费一级 | 久久亚洲精品中文字幕二区 | 国产成人综合在线视频 | 亚洲天堂黄| 九九视频免费观看 | 亚洲第一黄色网 | 香蕉97碰碰视频免费 | 美女很黄很黄免费的 | 亚洲第五色综合网啪啪 | 国产成人精品日本亚洲语音1 | 国产成人精品一区二区三在线观看 | 色熟| 国产精品成人免费观看 | 日韩黄色一级片 | 久久99亚洲精品一区二区 | 亚洲依依成人综合在线网址 | 久久福利青草免费精品 | 日本www高清 | 97公开视频 | 国产成人香蕉在线视频网站 | 久久99精品久久久久久h | 成人18视频在线观看 | 加勒比色久综合在线 | 日韩精品视频美在线精品视频 | 黄色w站| 99r精品在线 | 国产一精品一aⅴ一免费 | 国内精品一区二区2021在线 | 五月激激激综合网色播免费 | 国产精品无打码在线播放9久 | 2022国产精品手机在线观看 |