日本熟妇hd丰满老熟妇,中文字幕一区二区三区在线不卡 ,亚洲成片在线观看,免费女同在线一区二区

云數據庫MongoDB版同步至云原生數據倉庫AnalyticDB PostgreSQL版

重要

本文中含有需要您注意的重要提示信息,忽略該信息可能對您的業務造成影響,請務必仔細閱讀。

數據傳輸服務DTS(Data Transmission Service)支持將MongoDB的數據同步到AnalyticDB PostgreSQL版實例中。本文以云數據庫MongoDB版(副本集架構)為源,為您介紹同步操作的步驟。

前提條件

  • 已創建存儲空間大于源云數據庫MongoDB版實例已占用存儲空間的目標AnalyticDB PostgreSQL版實例。創建方法,請參見創建實例

    說明

    建議目標實例的存儲空間比源數據庫已使用的存儲空間大10%。

  • 已在目標AnalyticDB PostgreSQL版實例中創建用于接收數據的數據庫、Schema、具有主鍵列的表。創建方法,請參見SQL語法

    重要
    • 請務必確保目標表的數據類型與源MongoDB的數據兼容。例如,若MongoDB中的_id為ObjectId類型,則對應AnalyticDB PostgreSQL版實例中數據類型需為varchar

    • AnalyticDB PostgreSQL版實例中目標表的列名不能為_id_value。

  • 若源為分片集群架構的云數據庫MongoDB版,則還需為所有Shard節點申請連接地址,且各Shard的賬號和密碼需保持一致。申請方法,請參見申請Shard或ConfigServer節點連接地址

注意事項

類型

說明

源庫限制

  • 帶寬要求:源庫所屬的服務器需具備足夠的出口帶寬,否則將影響數據同步速率。

  • 若需要進行編輯(如集合的名稱映射),則單次同步任務最多支持同步1000個集合。當超出數量限制,任務提交后會顯示請求報錯,此時建議您拆分待同步的集合,分批配置多個任務,或者配置整庫的同步任務。

  • 若源MongoDB為分片集群架構的實例,則待同步集合中的_id字段需具有唯一性,否則可能會導致數據不一致。

  • 若源MongoDB為分片集群架構的實例,則源Mongos節點的數量不能超過10個。同時,請確保分片集群架構的MongoDB實例中沒有孤立文檔,否則可能會導致數據不一致甚至任務失敗。更多信息,請參見孤立文檔如何清理MongoDB(分片集群架構)的孤立文檔

  • 源庫不支持單節點架構的MongoDB、Azure Cosmos DB for MongoDB和彈性集群的Amazon DocumentDB。

  • 源庫需開啟Oplog日志,并確保Oplog日志至少保留7天以上;或者開啟變更流(Change Streams),并確保DTS能夠通過Change Streams訂閱到源庫最近7天內的數據變更。否則可能會因無法獲取源庫的數據變更而導致任務失敗,極端情況下甚至可能會導致數據不一致或丟失。由此導致的問題,不在DTS的SLA保障范圍內。

    重要
    • 建議通過Oplog日志獲取源庫的數據變更。

    • 僅4.0及以上版本的MongoDB支持通過Change Streams獲取數據變更,使用Change Streams獲取源庫的數據變更不支持雙向同步。

    • 源庫為Amazon DocumentDB(非彈性集群)時,需要手動開啟Change Streams,并在配置任務時將遷移方式選擇為ChangeStream,將架構類型選擇為分片集群架構

  • 源庫的操作限制:

    • 在全量同步階段,請勿執行庫或集合的結構變更(包含數組類型數據的更新),否則會導致數據遷移任務失敗或源庫與目標庫的數據不一致。

    • 如僅執行全量數據同步,請勿向源實例中寫入新的數據,否則會導致源庫與目標庫的數據不一致。為實時保持數據一致性,建議選擇全量數據同步和增量數據同步。

  • 當源庫為分片集群架構的MongoDB時,若源庫的均衡器Balancer存在均衡數據的行為,則可能會導致實例產生延遲。

其他限制

  • 僅支持集合級別的同步。

  • 目標AnalyticDB PostgreSQL版實例中不能有名稱為_id_value的字段,否則會導致同步失敗。

  • AnalyticDB PostgreSQL版實例中數據類型不兼容MongoDB的數據,則會導致任務失敗。

  • 不支持同步admin和local庫中的數據。

  • 目標表暫不支持AO表。

  • 不保留事務信息,即源庫中的事務同步到目標庫時會轉變為單條的記錄。

  • 執行數據同步前需評估源庫和目標庫的性能,同時建議在業務低峰期執行數據同步。否則全量數據同步時DTS占用源和目標庫一定讀寫資源,可能會導致數據庫的負載上升。

  • 由于全量數據同步會并發執行INSERT操作,導致目標數據庫的集合產生碎片,因此全量同步完成后目標數據庫的集合存儲空間會大于源實例的集合存儲空間。

  • 請確認DTS對數據類型為FLOAT或DOUBLE的列的同步精度是否符合業務預期。DTS會通過ROUND(COLUMN,PRECISION)來讀取這兩類列的值。如果沒有明確定義其精度,DTS對FLOAT的同步精度為38位,對DOUBLE的同步精度為308位。

  • DTS會嘗試恢復七天之內同步失敗任務。因此在業務切換至目標實例前,請務必結束或釋放該任務,或者用revoke命令回收DTS訪問目標實例賬號的寫權限。避免該任務被自動恢復后,源端數據覆蓋目標實例的數據。

  • 由于DTS增量同步的延遲時間是根據同步到目標庫最后一條數據的時間戳和當前時間戳對比得出,源庫長時間未執行更新操作可能導致延遲信息不準確。如果任務顯示的延遲時間過大,您可以在源庫執行一個更新操作來更新延遲信息。

  • 若實例運行失敗,DTS技術支持人員將在8小時內嘗試恢復該實例。在恢復失敗實例的過程中,可能會對該實例進行重啟、調整參數等操作。

    說明

    在調整參數時,僅會修改實例的參數,不會對數據庫中的參數進行修改。可能修改的參數,包括但不限于修改實例參數中的參數。

費用說明

同步類型

鏈路配置費用

全量數據同步

不收費。

增量數據同步

收費,詳情請參見計費概述

同步類型說明

同步類型

說明

全量同步

將源云數據庫MongoDB版同步對象的存量數據全部同步到目標AnalyticDB PostgreSQL版實例中。

增量同步

在全量同步的基礎上,將源云數據庫MongoDB版的增量更新同步到目標AnalyticDB PostgreSQL版實例中。

說明
  • 僅支持增量同步在集合中插入、更新、刪除文檔的操作。

  • 在同步增量更新文檔的數據時,僅支持同步使用$set命令更新的操作。

數據庫賬號的權限要求

數據庫

所需權限

賬號創建及授權方式

云數據庫MongoDB版

待同步庫、admin庫和local庫的read權限。

MongoDB數據庫賬號權限管理

目標AnalyticDB PostgreSQL版

目標庫的讀寫權限。

創建數據庫賬號用戶權限管理

說明

您可以使用初始賬號或具備RDS_SUPERUSER權限的賬號。

操作步驟

  1. 進入目標地域的同步任務列表頁面(二選一)。

    通過DTS控制臺進入

    1. 登錄數據傳輸服務DTS控制臺

    2. 在左側導航欄,單擊數據同步

    3. 在頁面左上角,選擇同步實例所屬地域。

    通過DMS控制臺進入

    說明

    實際操作可能會因DMS的模式和布局不同,而有所差異。更多信息,請參見極簡模式控制臺自定義DMS界面布局與樣式

    1. 登錄DMS數據管理服務

    2. 在頂部菜單欄中,選擇集成與開發 > 數據傳輸(DTS) > 數據同步

    3. 同步任務右側,選擇同步實例所屬地域。

  2. 單擊創建任務,進入任務配置頁面。

  3. 可選:在頁面右上角,單擊試用新版配置頁

    說明
    • 若您已進入新版配置頁(頁面右上角的按鈕為返回舊版配置頁),則無需執行此操作。

    • 新版配置頁和舊版配置頁部分參數有差異,建議使用新版配置頁。

  4. 配置源庫及目標庫信息。

    類別

    配置

    說明

    任務名稱

    DTS會自動生成一個任務名稱,建議配置具有業務意義的名稱(無唯一性要求),便于后續識別。

    源庫信息

    選擇已有連接信息

    您可以按實際需求,選擇是否使用已有數據庫實例。

    • 如使用已有實例,下方數據庫信息將自動填入,您無需重復輸入。

    • 如不使用已有實例,您需要配置下方的數據庫信息。

    說明
    • 您可以在數據連接管理頁面或新版配置頁面,將數據庫錄入DTS。更多信息,請參見數據連接管理

    • DMS控制臺的配置項為選擇DMS數據庫實例,您可以單擊新增DMS數據庫實例或在控制臺首頁將數據庫錄入DMS。更多信息,請參見云數據庫錄入他云/自建數據庫錄入

    數據庫類型

    選擇MongoDB

    接入方式

    選擇云實例

    實例地區

    選擇源云數據庫MongoDB版所屬的地域。

    是否跨阿里云賬號

    本示例使用當前阿里云賬號下的數據庫實例,需選擇不跨賬號

    架構類型

    本示例選擇副本集架構

    說明

    若您的源云數據庫MongoDB版分片集群架構,您還需要填寫Shard賬號Shard密碼

    遷移方式

    請根據實際情況,選擇增量數據同步的方式。

    • Oplog(推薦):

      若源庫已開啟Oplog日志,則支持此選項。

      說明

      本地自建MongoDB和云數據庫MongoDB版默認已開啟Oplog日志,且使用此方式同步增量數據時增量同步任務的延遲較小(拉取日志的速度較快),因此推薦選擇Oplog

    • ChangeStream

      若源庫已開啟變更流(Change Streams),則支持此選項。

      說明
      • 源庫為Amazon DocumentDB(非彈性集群)時,僅支持選擇ChangeStream

      • 源庫架構類型選擇為分片集群架構,無需填寫Shard賬號Shard密碼

    實例ID

    選擇源云數據庫MongoDB版的實例ID。

    鑒權數據庫名稱

    填入源云數據庫MongoDB版實例中數據庫賬號所屬的數據庫名稱,若未修改過則為默認的admin

    數據庫賬號

    填入源云數據庫MongoDB版的數據庫賬號,權限要求請參見數據庫賬號的權限要求

    數據庫密碼

    填入該數據庫賬號對應的密碼。

    連接方式

    DTS支持非加密連接SSL安全連接Mongo Atlas SSL三種連接方式。連接方式的選項與接入方式架構類型有關,請以控制臺為準。

    說明
    • 架構類型分片集群架構,且遷移方式Oplog的MongoDB數據庫,不支持SSL安全連接

    • 若源庫為自建(接入方式不為云實例副本集架構的MongoDB數據庫,并且選擇了SSL安全連接,DTS還支持上傳CA證書對連接進行校驗。

    目標庫信息

    選擇已有連接信息

    您可以按實際需求,選擇是否使用已有數據庫實例。

    • 如使用已有實例,下方數據庫信息將自動填入,您無需重復輸入。

    • 如不使用已有實例,您需要配置下方的數據庫信息。

    說明
    • 您可以在數據連接管理頁面或新版配置頁面,將數據庫錄入DTS。更多信息,請參見數據連接管理

    • DMS控制臺的配置項為選擇DMS數據庫實例,您可以單擊新增DMS數據庫實例或在控制臺首頁將數據庫錄入DMS。更多信息,請參見云數據庫錄入他云/自建數據庫錄入

    數據庫類型

    選擇AnalyticDB PostgreSQL

    接入方式

    選擇云實例

    實例地區

    選擇目標AnalyticDB PostgreSQL版實例所屬的地域。

    實例ID

    選擇目標AnalyticDB PostgreSQL版實例的名ID。

    數據庫名稱

    填入目標AnalyticDB PostgreSQL版實例中用于接收同步對象的數據庫名稱。

    數據庫賬號

    填入目標AnalyticDB PostgreSQL版實例的數據庫賬號,權限要求請參見數據庫賬號的權限要求

    數據庫密碼

    填入該數據庫賬號對應的密碼。

  5. 配置完成后,在頁面下方單擊測試連接以進行下一步

    說明
    • 請確保DTS服務的IP地址段能夠被自動或手動添加至源庫和目標庫的安全設置中,以允許DTS服務器的訪問。更多信息,請參見添加DTS服務器的IP地址段

    • 若源庫或目標庫為自建數據庫(接入方式不是云實例),則還需要在彈出的DTS服務器訪問授權對話框單擊測試連接

  6. 配置任務對象。

    1. 對象配置頁面,配置待同步的對象。

      配置

      說明

      同步類型

      固定選中增量同步。僅支持選中全量同步,不支持庫表結構同步。預檢查完成后,DTS會將源實例中待同步對象的數據在目標集群中初始化,作為后續增量同步數據的基線數據。

      實例級別選擇所需同步的DDL和DML

      按實例級別選擇需要增量同步的操作。

      說明

      如需按集合級別選擇需要增量同步的操作,請在已選擇對象中右鍵單擊同步對象,然后在彈跳框中勾選。

      目標已存在表的處理模式

      • 預檢查并報錯攔截:檢查目標數據庫中是否有同名的表。如果目標數據庫中沒有同名的表,則通過該檢查項目;如果目標數據庫中有同名的表,則在預檢查階段提示錯誤,數據同步任務不會被啟動。

        說明

        如果目標庫中同名的表不方便刪除或重命名,您可以更改該表在目標庫中的名稱,請參見庫表列名映射

      • 忽略報錯并繼續執行:跳過目標數據庫中是否有同名表的檢查項。

        警告

        選擇為忽略報錯并繼續執行,可能導致數據不一致,給業務帶來風險,例如:

        • 表結構一致的情況下,如在目標庫遇到與源庫主鍵或唯一鍵的值相同的記錄:

          • 全量期間,DTS會保留目標集群中的該條記錄,即源庫中的該條記錄不會同步至目標數據庫中。

          • 增量期間,DTS不會保留目標集群中的該條記錄,即源庫中的該條記錄會覆蓋至目標數據庫中。

        • 表結構不一致的情況下,可能會導致無法初始化數據、只能同步部分列的數據或同步失敗,請謹慎操作。

      源庫對象

      源庫對象框中單擊待同步對象,然后單擊向右將其移動至已選擇對象框。

      說明

      同步對象的選擇粒度為集合。

      已選擇對象

      1. 編輯庫名映射。

        1. 右鍵單擊已選擇對象中的待同步集合所屬的數據庫。

          image

        2. 庫名修改為目標AnalyticDB PostgreSQL版實例中接收數據的Schema名稱。

          image

        3. 可選:勾選所需同步的DML&DDL操作區域選擇所需增量同步的操作。image

        4. 單擊確定

      2. 編輯表名映射。

        1. 右鍵單擊已選擇對象中的待同步的集合。

          image

        2. 表名稱修改為目標AnalyticDB PostgreSQL版實例中接收數據的表名稱。image

        3. 可選:設置過濾條件,設置方法請參見設置過濾條件image

        4. 可選:勾選所需同步的DML&DDL操作區域選擇所需增量同步的操作。image

      3. 配置MongoDB中需要同步的字段(Field)。

        1. 單擊+ 新增列image

        2. 填寫列名稱image

          說明

          此處填寫的是目標AnalyticDB PostgreSQL版實例中接收數據表的列名。

        3. 選擇列數據的類型

          重要

          請務必確保目標表的數據類型與源MongoDB的數據兼容。

        4. 可選:配置列數據的長度精度

        5. 賦值下方的文本框中填寫bson_value()表達式,詳情請參見賦值配置示例image

          重要
          • 目標表的主鍵列必須賦值為bson_value("_id")

          • 在配置bson_value()表達式時,需要按照層級關系配置到最小子字段,否則可能會導致數據丟失或任務失敗。

        6. 重復操作(步驟1~步驟5),將待同步的字段與目標表的字段進行逐一映射。image

        7. 單擊確定

    2. 單擊下一步高級配置,進行高級參數配置。

      配置

      說明

      選擇調度該任務的專屬集群

      DTS默認將任務調度到共享集群上,您無需選擇。若您希望任務更加穩定,可以購買專屬集群來運行DTS同步任務。更多信息,請參見什么是DTS專屬集群

      源庫、目標庫無法連接后的重試時間

      在同步任務啟動后,若源庫或目標庫連接失敗則DTS會報錯,并會立即進行持續的重試連接,默認持續重試時間為720分鐘,您也可以在取值范圍(10~1440分鐘)內自定義重試時間,建議設置30分鐘以上。如果DTS在設置的重試時間內重新連接上源庫、目標庫,同步任務將自動恢復。否則,同步任務將會失敗。

      說明
      • 針對同源或者同目標的多個DTS實例,如DTS實例A和DTS實例B,設置網絡重試時間時A設置30分鐘,B設置60分鐘,則重試時間以低的30分鐘為準。

      • 由于連接重試期間,DTS將收取任務運行費用,建議您根據業務需要自定義重試時間,或者在源和目標庫實例釋放后盡快釋放DTS實例。

      源庫、目標庫出現其他問題后的重試時間

      在同步任務啟動后,若源庫或目標庫出現非連接性的其他問題(如DDL或DML執行異常),則DTS會報錯并會立即進行持續的重試操作,默認持續重試時間為10分鐘,您也可以在取值范圍(1~1440分鐘)內自定義重試時間,建議設置10分鐘以上。如果DTS在設置的重試時間內相關操作執行成功,同步任務將自動恢復。否則,同步任務將會失敗。

      重要

      源庫、目標庫出現其他問題后的重試時間的值需要小于源庫、目標庫無法連接后的重試時間的值。

      是否限制全量遷移速率

      在全量同步階段,DTS將占用源庫和目標庫一定的讀寫資源,可能會導致數據庫的負載上升。您可以根據實際情況,選擇是否對全量同步任務進行限速設置(設置每秒查詢源庫的速率QPS每秒全量遷移的行數RPS每秒全量遷移的數據量(MB)BPS),以緩解目標庫的壓力。

      說明

      僅當同步類型選擇了全量同步時才可以配置。

      同一張表內主鍵_id的數據類型是否唯一

      待同步的數據中,同一個集合內主鍵_id的數據類型是否唯一。

      說明

      僅當同步類型選擇了全量同步時才可以配置。

      • :唯一。在全量同步階段,DTS將不會掃描源庫待同步數據中主鍵的數據類型。

      • :不唯一。在全量同步階段,DTS將掃描源庫待同步數據中主鍵的數據類型。

      是否限制增量同步速率

      您也可以根據實際情況,選擇是否對增量同步任務進行限速設置(設置每秒增量同步的行數RPS每秒增量同步的數據量(MB)BPS),以緩解目標庫的壓力。

      環境標簽

      您可以根據實際情況,選擇用于標識實例的環境標簽。本示例無需選擇。

      配置ETL功能

      選擇是否配置ETL功能。關于ETL的更多信息,請參見什么是ETL

      監控告警

      是否設置告警,當同步失敗或延遲超過閾值后,將通知告警聯系人。

  7. 保存任務并進行預檢查。

    • 若您需要查看調用API接口配置該實例時的參數信息,請將鼠標光標移動至下一步保存任務并預檢查按鈕上,然后單擊氣泡中的預覽OpenAPI參數

    • 若您無需查看或已完成查看API參數,請單擊頁面下方的下一步保存任務并預檢查

    說明
    • 在同步作業正式啟動之前,會先進行預檢查。只有預檢查通過后,才能成功啟動同步作業。

    • 如果預檢查失敗,請單擊失敗檢查項后的查看詳情,并根據提示修復后重新進行預檢查。

    • 如果預檢查產生警告:

      • 對于不可以忽略的檢查項,請單擊失敗檢查項后的查看詳情,并根據提示修復后重新進行預檢查。

      • 對于可以忽略無需修復的檢查項,您可以依次單擊點擊確認告警詳情確認屏蔽確定重新進行預檢查,跳過告警檢查項重新進行預檢查。如果選擇屏蔽告警檢查項,可能會導致數據不一致等問題,給業務帶來風險。

  8. 購買實例。

    1. 預檢查通過率顯示為100%時,單擊下一步購買

    2. 購買頁面,選擇數據同步實例的計費方式、鏈路規格,詳細說明請參見下表。

      類別

      參數

      說明

      信息配置

      計費方式

      • 預付費(包年包月):在新建實例時支付費用。適合長期需求,價格比按量付費更實惠,且購買時長越長,折扣越多。

      • 后付費(按量付費):按小時扣費。適合短期需求,用完可立即釋放實例,節省費用。

      資源組配置

      實例所屬的資源組,默認為default resource group。更多信息,請參見什么是資源管理

      鏈路規格

      DTS為您提供了不同性能的同步規格,同步鏈路規格的不同會影響同步速率,您可以根據業務場景進行選擇。更多信息,請參見數據同步鏈路規格說明

      訂購時長

      在預付費模式下,選擇包年包月實例的時長和數量,包月可選擇1~9個月,包年可選擇1年、2年、3年和5年。

      說明

      該選項僅在付費類型為預付費時出現。

    3. 配置完成后,閱讀并勾選《數據傳輸(按量付費)服務條款》

    4. 單擊購買并啟動,并在彈出的確認對話框,單擊確定

      您可在數據同步界面查看具體任務進度。

賦值配置示例

源MongoDB的數據結構

{
  "_id":"62cd344c85c1ea6a2a9f****",
  "person":{
    "name":"neo",
    "age":26,
    "sex":"male"
  }
}

目標AnalyticDB PostgreSQL版的表結構

列名稱

類型

mongo_id

varchar

說明

主鍵列。

person_name

varchar

person_age

decimal

新增列配置

重要

請按照層級關系正確配置bson_value()表達式,否則可能會導致數據丟失或任務失敗。例如,若您配置的表達式為bson_value("person"),DTS將無法把源端person的子字段(name、age、sex)的增量變更數據寫入到目標端。

列名稱

類型

賦值

mongo_id

STRING

bson_value("_id")

person_name

STRING

bson_value("person","name")

person_age

DECIMAL

bson_value("person","age")