R語言中如何在數(shù)據可視化過程中調整因子順序

這篇文章將為大家詳細講解有關R語言中如何在數(shù)據可視化過程中調整因子順序,文章內容質量較高,因此小編分享給大家做個參考,希望大家閱讀完這篇文章后對相關知識有一定的了解。

公司主營業(yè)務:成都網站制作、做網站、外貿營銷網站建設、移動網站開發(fā)等業(yè)務。幫助企業(yè)客戶真正實現(xiàn)互聯(lián)網宣傳,提高企業(yè)的競爭能力。創(chuàng)新互聯(lián)是一支青春激揚、勤奮敬業(yè)、活力青春激揚、勤奮敬業(yè)、活力澎湃、和諧高效的團隊。公司秉承以“開放、自由、嚴謹、自律”為核心的企業(yè)文化,感謝他們對我們的高要求,感謝他們從不同領域給我們帶來的挑戰(zhàn),讓我們激情的團隊有機會用頭腦與智慧不斷的給客戶帶來驚喜。創(chuàng)新互聯(lián)推出彰武免費做網站回饋大家。

實例操練

這個例子使用的數(shù)據集為tidyverse包自帶的數(shù)據集,大家可以使用?gss_cat查看相關變量,這兒不再贅述。

在數(shù)據可視化過程中改變因子順序是一個經常性的操作,比如我們想看看不同religions的average number of hours spent  watching TV per day有什么不同,我們可以用以下代碼:

relig_summary <- gss_cat %>%   group_by(relig) %>%   summarise(     age = mean(age, na.rm = TRUE),     tvhours = mean(tvhours, na.rm = TRUE),     n = n()   )  ggplot(relig_summary, aes(tvhours, relig)) + geom_point()

運行代碼得到輸出的點圖如下:

R語言中如何在數(shù)據可視化過程中調整因子順序

上面的這個點圖其實很不好看,我們可能會覺得能不能把religions的順序變一變,讓有最小tvhours的religion在y軸的最下面,有最大tvhours的在最上面。

怎么做呢,需要用到fct_reorder()方法,這個方法取2個參數(shù):

  • 第一個就是你想改變順序的因子,本例中:religions

  • 第二個,改變順序的參照物,本例中:tvhours

代碼如下:

ggplot(relig_summary, aes(tvhours, fct_reorder(relig, tvhours))) +   geom_point()

R語言中如何在數(shù)據可視化過程中調整因子順序

可以看到,改變了religions的順序后這個圖就更加清晰明白了。

再看一個例子:

rincome_summary <- gss_cat %>%   group_by(rincome) %>%   summarise(     age = mean(age, na.rm = TRUE),     tvhours = mean(tvhours, na.rm = TRUE),     n = n()   )  ggplot(rincome_summary, aes(age, fct_reorder(rincome, age))) + geom_point()

上面的代碼,可以畫出按年齡排序后不同rincome和age的關系:

R語言中如何在數(shù)據可視化過程中調整因子順序

但是,問題出在按年齡排序后我們的收入(y軸)顯得很亂,所以這個方法并不好,考慮到收入本來就是有順序的,所以好的處理方法為保留收入的原始順序,于是我們寫出了如下代碼:

rincome_summary <- gss_cat %>%   group_by(rincome) %>%   summarise(     age = mean(age, na.rm = TRUE),     tvhours = mean(tvhours, na.rm = TRUE),     n = n()   )  ggplot(rincome_summary, aes(age, rincome)) + geom_point()

R語言中如何在數(shù)據可視化過程中調整因子順序

這次再看我們的圖,雖然其他的收入levels都排的挺好,但是我們不希望“Not  applicable”排在第一。這個時候我們可以用fct_relevel(),它也有2個參數(shù):

  • 需要排序的因子,本例中:rincome

  • 需要放在最前面的levels,本例中:Not applicable

代碼如下:

ggplot(rincome_summary, aes(age, fct_relevel(rincome, "Not applicable"))) +   geom_point()

R語言中如何在數(shù)據可視化過程中調整因子順序

這一下,我們的圖形就比較滿意了。

再看一個例子:線圖的顏色控制:

by_age <- gss_cat %>%   filter(!is.na(age)) %>%   count(age, marital) %>%   group_by(age) %>%   mutate(prop = n / sum(n))  ggplot(by_age, aes(age, prop, colour = marital)) +   geom_line(na.rm = TRUE)  ggplot(by_age, aes(age, prop, colour = fct_reorder2(marital, age, prop))) +   geom_line() +   labs(colour = "marital")

上面的代碼畫的是不同的年齡中婚姻狀況的比例變化:

R語言中如何在數(shù)據可視化過程中調整因子順序

我們通過fct_reorder2實現(xiàn)了圖例和x變量最大時y的值的順序一致,可以更加明晰。

最后再看一個柱狀圖調整因子順序的例子

下面的代碼可以,正序逆序改變x軸標簽:

  1. gss_cat %>% 

  2.   mutate(marital = marital %>% fct_infreq() ) %>% 

  3.   ggplot(aes(marital)) + 

  4.     geom_bar() 

  5.  

  6. gss_cat %>% 

  7.   mutate(marital = marital %>% fct_infreq() %>% fct_rev()) %>% 

  8.   ggplot(aes(marital)) + 

  9.     geom_bar() 


R語言中如何在數(shù)據可視化過程中調整因子順序

R語言中如何在數(shù)據可視化過程中調整因子順序

大家可以在自己電腦上運行試試,關鍵就在于fct_rev()。

今天通過3個例子給大家介紹了可視化中因子順序的改變,感謝大家耐心看完。發(fā)表這些東西的主要目的就是督促自己,希望大家關注評論指出不足,一起進步。

關于R語言中如何在數(shù)據可視化過程中調整因子順序就分享到這里了,希望以上內容可以對大家有一定的幫助,可以學到更多知識。如果覺得文章不錯,可以把它分享出去讓更多的人看到。

本文名稱:R語言中如何在數(shù)據可視化過程中調整因子順序
當前URL:http://muchs.cn/article4/ijddoe.html

成都網站建設公司_創(chuàng)新互聯(lián),為您提供自適應網站、品牌網站制作網站設計、企業(yè)網站制作網站維護、營銷型網站建設

廣告

聲明:本網站發(fā)布的內容(圖片、視頻和文字)以用戶投稿、用戶轉載內容為主,如果涉及侵權請盡快告知,我們將會在第一時間刪除。文章觀點不代表本網站立場,如需處理請聯(lián)系客服。電話:028-86922220;郵箱:631063699@qq.com。內容未經允許不得轉載,或轉載時需注明來源: 創(chuàng)新互聯(lián)

成都定制網站網頁設計