NoSQL資料庫 Redis適用場景及產品定位

2021-07-04 04:01:48 字數 2989 閱讀 6084

傳統mysql+ memcached架構遇到的問題

實際mysql是適合進行海量資料儲存的,通過memcached將熱點資料載入到cache,加速訪問,很多公司都曾經使用過這樣的架構,但隨著業務資料量的不斷增加,和訪問量的持續增長,我們遇到了很多問題:

1.mysql需要不斷進行拆庫拆表,memcached也需不斷跟著擴容,擴容和維護工作佔據大量開發時間。

2.memcached與mysql資料庫資料一致性問題。

3.memcached資料命中率低或down機,大量訪問直接穿透到db,mysql無法支撐。

4.跨機房cache同步問題。

眾多nosql百花齊放,如何選擇

最近幾年,業界不斷湧現出很多各種各樣的nosql產品,那麼如何才能正確地使用好這些產品,最大化地發揮其長處,是我們需要深入研究和思考的問題,實際歸根結底最重要的是了解這些產品的定位,並且了解到每款產品的tradeoffs,在實際應用中做到揚長避短,總體上這些nosql主要用於解決以下幾種問題

1.少量資料儲存,高速讀寫訪問。此類產品通過資料全部in-momery 的方式來保證高速訪問,同時提供資料落地的功能,實際這正是redis最主要的適用場景。

2.海量資料儲存,分布式系統支援,資料一致性保證,方便的集群節點新增/刪除。

4.schema free,auto-sharding等。比如目前常見的一些文件資料庫都是支援schema-free的,直接儲存json格式資料,並且支援auto-sharding等功能,比如mongodb。

面對這些不同型別的nosql產品,我們需要根據我們的業務場景選擇最合適的產品。

redis適用場景,如何正確的使用

前面已經分析過,redis最適合所有資料in-momory的場景,雖然redis也提供持久化功能,但實際更多的是乙個disk-backed的功能,跟傳統意義上的持久化有比較大的差別,那麼可能大家就會有疑問,似乎redis更像乙個加強版的memcached,那麼何時使用memcached,何時使用redis呢?

redis與memcached的比較

1.網路io模型

memcached是多執行緒,非阻塞io復用的網路模型,分為監聽主線程和worker子執行緒,監聽執行緒監聽網路連線,接受請求後,將連線描述字pipe 傳遞給worker執行緒,進行讀寫io, 網路層使用libevent封裝的事件庫,多執行緒模型可以發揮多核作用,但是引入了cache coherency和鎖的問題,比如,memcached最常用的stats 命令,實際memcached所有操作都要對這個全域性變數加鎖,進行計數等工作,帶來了效能損耗。

(memcached網路io模型)

redis使用單執行緒的io復用模型,自己封裝了乙個簡單的aeevent事件處理框架,主要實現了epoll、kqueue和select,對於單純只有io操作來說,單執行緒可以將速度優勢發揮到最大,但是redis也提供了一些簡單的計算功能,比如排序、聚合等,對於這些操作,單執行緒模型實際會嚴重影響整體吞吐量,cpu計算過程中,整個io排程都是被阻塞住的。

2.記憶體管理方面

memcached使用預分配的記憶體池的方式,使用slab和大小不同的chunk來管理記憶體,item根據大小選擇合適的chunk儲存,記憶體池的方式可以省去申請/釋放記憶體的開銷,並且能減小記憶體碎片產生,但這種方式也會帶來一定程度上的空間浪費,並且在記憶體仍然有很大空間時,新的資料也可能會被剔除,原因可以參考timyang的文章:

redis使用現場申請記憶體的方式來儲存資料,並且很少使用free-list等方式來優化記憶體分配,會在一定程度上存在記憶體碎片,redis跟據儲存命令引數,會把帶過期時間的資料單獨存放在一起,並把它們稱為臨時資料,非臨時資料是永遠不會被剔除的,即便物理記憶體不夠,導致swap也不會剔除任何非臨時資料(但會嘗試剔除部分臨時資料),這點上redis更適合作為儲存而不是cache。

3.資料一致性問題

memcached提供了cas命令,可以保證多個併發訪問操作同乙份資料的一致性問題。 redis沒有提供cas 命令,並不能保證這點,不過redis提供了事務的功能,可以保證一串 命令的原子性,中間不會被任何操作打斷。

4.儲存方式及其它方面

memcached基本只支援簡單的key-value儲存,不支援列舉,不支援持久化和複製等功能

redis除key/value之外,還支援list,set,sorted set,hash等眾多資料結構,提供了keys

5.關於不同語言的客戶端支援

在不同語言的客戶端方面,memcached和redis都有豐富的第三方客戶端可供選擇,不過因為memcached發展的時間更久一些,目前看在客戶端支援方面,memcached的很多客戶端更加成熟穩定,而redis由於其協議本身就比memcached複雜,加上作者不斷增加新的功能等,對應第三方客戶端跟進速度可能會趕不上,有時可能需要自己在第三方客戶端基礎上做些修改才能更好的使用。

根據以上比較不難看出,當我們不希望資料被踢出,或者需要除key/value之外的更多資料型別時,或者需要落地功能時,使用redis比使用memcached更合適。

關於redis的一些周邊功能

redis除了作為儲存之外還提供了一些其它方面的功能,比如聚合計算、pubsub、scripting等,對於此類功能需要了解其實現原理,清楚地了解到它的侷限性後,才能正確的使用,比如pubsub功能,這個實際是沒有任何持久化支援的,消費方連線閃斷或重連之間過來的訊息是會全部丟失的,又比如聚合計算和scripting等功能受redis單執行緒模型所限,是不可能達到很高的吞吐量的,需要謹慎使用。

總的來說redis作者是一位非常勤奮的開發者,可以經常看到作者在嘗試著各種不同的新鮮想法和思路,針對這些方面的功能就要求我們需要深入了解後再使用。

總結:

1.redis使用最佳方式是全部資料in-memory。

2.redis更多場景是作為memcached的替代者來使用。

3.當需要除key/value之外的更多資料型別支援時,使用redis更合適。

4.當儲存的資料不能被剔除時,使用redis更合適。

NoSQL資料庫之 Redis

redis是基於記憶體的nosql資料庫。前身是memcached,但是memcached不支援持久化,沒有豐富的資料型別。redis存放的資料是key values鍵值對。1 解壓 tar zxvf redis 3.0.5.tar.gz 預編譯,需要gcc環境。apt get install gc...

NoSql資料庫之redis資料庫簡介及安裝

一 redis資料庫簡介 redis是用c語言開發的乙個開源的高效能鍵值對 key value 資料庫。它通過提供多種鍵值資料型別來適應不同場景下的儲存需求,目前為止redis支援的鍵值資料型別如 下 1 字串型別 string 2 雜湊型別 hash 3 列表型別 list 4 集合型別 set ...

NoSQL資料庫Redis幾個認識誤區

前幾天微博發生了一起大的系統故障 很多技術的朋友都比較關心,其中的原因不會超出james hamilton在on designing and deploying internet scale service 1 概括的那幾個範圍,james第一條經驗 design for failure 是所有網際...