日本熟妇hd丰满老熟妇,中文字幕一区二区三区在线不卡 ,亚洲成片在线观看,免费女同在线一区二区

SLS同步至ClickHouse集群

重要

本文中含有需要您注意的重要提示信息,忽略該信息可能對您的業務造成影響,請務必仔細閱讀。

本文為您介紹如何使用數據傳輸服務DTS(Data Transmission Service)將日志服務SLS的數據同步至云數據庫ClickHouse集群。

前提條件

  • 已將待同步的數據采集到日志服務的Logstore中,詳情請參見數據采集概述

  • 已創建目標ClickHouse集群,詳情請參見新建集群

  • 已在目標ClickHouse集群創建用于接收數據的數據庫和表,詳情請參見創建數據庫創建表對象命名規范限制

    說明
    • 日志服務SLS中的Logstore對應ClickHouse集群的數據庫,Topic對應數據表。

    • 在ClickHouse集群中,無需為Logstore中以__開頭并__結尾的索引字段創建相應的列。

注意事項

類型

說明

源庫限制

  • 須確保待同步Logstore的數據保存時間為7天以上。

  • 待同步的Logstore需要關閉自動分裂Shard功能。關閉方法,請參見修改Logstore配置

  • DTS實例運行期間,請勿對Shard進行變更操作(如分裂Shard和合并Shard等),否則可能會導致數據丟失。

其他限制

  • 當前僅華北1(青島)和華北2(北京)地域支持此功能。

  • 不支持DTS Serverless實例。

  • 不支持庫表結構同步。

  • 不支持修改同步對象。

  • 不支持同步以__開頭并__結尾的索引字段。

  • 若您需要將Logstore中所有Topic的數據同步到ClickHouse集群的同一張表,請在配置同步對象時在表名文本框中填入.*,否則可能會因Topic被過濾而導致相應數據丟失。

  • 重啟任務可能會導致少量的數據重復。

  • 實例包含全量同步和增量同步,在任務列表合并顯示為增量同步。

  • 待同步數據庫的數量符合云數據庫ClickHouse的限制,即不超過256個。

  • 若您采用先購買再配置的方式配置實例,在購買實例時需正確選擇分布式數據庫節點數量

    說明

    分布式數據庫節點數量必須與待同步數據所屬Logstore的Shard數一致。Logstore中Shard數量的查看方法,請參見管理Shard

  • 全量數據初始化,DTS將會占用源和目標庫一定的讀寫資源,可能會導致數據庫的負載上升。因此建議在執行數據同步前評估源庫和目標庫的性能,并在業務低峰期執行數據同步(例如源庫和目標庫的CPU負載在30%以下)。

  • 在DTS同步期間,不允許有除DTS外的數據寫入目標庫,否則會導致源庫與目標庫數據不一致。

  • 若實例運行失敗,DTS技術支持人員將在8小時內嘗試恢復該實例。在恢復失敗實例的過程中,可能會對該實例進行重啟、調整參數等操作。

    說明

    在調整參數時,僅會修改實例的參數,不會對數據庫中的參數進行修改。可能修改的參數,包括但不限于修改實例參數中的參數。

費用說明

同步類型

鏈路配置費用

全量數據同步

不收費。

增量數據同步

收費,詳情請參見計費概述

數據庫賬號的權限要求

數據庫

所需權限

創建及授權方式

目標ClickHouse集群

  • 22.8及以上版本:目標庫的讀寫權限,高權限賬號符合要求。

  • 21.8版本:讀寫和設置權限允許DDL

社區兼容版賬號管理企業版賬號管理

準備工作

在創建DTS實例之前,您需要先創建RAM用戶并完成相應的授權,以確保DTS能夠通過該RAM用戶的AccessKey ID和AccessKey Secret讀取日志服務中待同步的數據。

  1. 創建RAM用戶。

    1. 訪問RAM用戶列表

    2. 在頁面左上角,單擊創建用戶

    3. 填入登錄名稱,并在訪問方式區域選中使用永久 AccessKey 訪問

    4. 單擊確定

      重要

      RAM用戶創建成功后,請保存AccessKey ID與AccessKey Secret信息。

  2. 返回RAM用戶列表,查找創建好的RAM用戶。

  3. 在目標RAM用戶的操作列,單擊添加權限

  4. 權限策略下方的文本框中,搜索并選中AliyunLogReadOnlyAccess策略。

    說明

    AliyunLogReadOnlyAccess策略擁有日志服務的只讀權限,授權了該策略的子賬號可以訪問日志服務。您也可以按需進行自定義策略,更多信息請參見創建自定義權限策略

  5. 單擊確認新增授權,完成授權操作。

操作步驟

  1. 進入目標地域的同步任務列表頁面(二選一)。

    通過DTS控制臺進入

    1. 登錄數據傳輸服務DTS控制臺

    2. 在左側導航欄,單擊數據同步

    3. 在頁面左上角,選擇同步實例所屬地域。

    通過DMS控制臺進入

    說明

    實際操作可能會因DMS的模式和布局不同,而有所差異。更多信息,請參見極簡模式控制臺自定義DMS界面布局與樣式

    1. 登錄DMS數據管理服務

    2. 在頂部菜單欄中,選擇集成與開發 > 數據傳輸(DTS) > 數據同步

    3. 同步任務右側,選擇同步實例所屬地域。

  2. 單擊創建任務,進入任務配置頁面。

  3. 可選:在頁面右上角,單擊試用新版配置頁

    說明
    • 若您已進入新版配置頁(頁面右上角的按鈕為返回舊版配置頁),則無需執行此操作。

    • 新版配置頁和舊版配置頁部分參數有差異,建議使用新版配置頁。

  4. 配置源庫及目標庫信息。

    類別

    配置

    說明

    任務名稱

    DTS會自動生成一個任務名稱,建議配置具有業務意義的名稱(無唯一性要求),便于后續識別。

    源庫信息

    選擇已有連接信息

    您可以按實際需求,選擇是否使用已有數據庫實例。

    • 如使用已有實例,下方數據庫信息將自動填入,您無需重復輸入。

    • 如不使用已有實例,您需要配置下方的數據庫信息。

    說明
    • 您可以在數據連接管理頁面或新版配置頁面,將數據庫錄入DTS。更多信息,請參見數據連接管理

    • DMS控制臺的配置項為選擇DMS數據庫實例,您可以單擊新增DMS數據庫實例或在控制臺首頁將數據庫錄入DMS。更多信息,請參見云數據庫錄入他云/自建數據庫錄入

    數據庫類型

    選擇SLS

    接入方式

    選擇云實例

    實例地區

    選擇源日志服務中待同步數據所屬項目(Project)的地域。

    Project

    選擇源日志服務中待同步數據所屬的Project。

    Logstore

    選擇源日志服務中待同步數據所屬的Logstore。

    AccessKey ID

    填入在準備工作中所創建的RAM用戶的AccessKey ID和AccessKey Secret。

    AccessKey Secret

    目標庫信息

    選擇已有連接信息

    您可以按實際需求,選擇是否使用已有數據庫實例。

    • 如使用已有實例,下方數據庫信息將自動填入,您無需重復輸入。

    • 如不使用已有實例,您需要配置下方的數據庫信息。

    說明
    • 您可以在數據連接管理頁面或新版配置頁面,將數據庫錄入DTS。更多信息,請參見數據連接管理

    • DMS控制臺的配置項為選擇DMS數據庫實例,您可以單擊新增DMS數據庫實例或在控制臺首頁將數據庫錄入DMS。更多信息,請參見云數據庫錄入他云/自建數據庫錄入

    數據庫類型

    選擇ClickHouse

    接入方式

    選擇云實例

    實例地區

    選擇目標ClickHouse集群所屬地域。

    是否跨阿里云賬號

    本示例使用當前阿里云賬號下的數據庫實例,需選擇不跨賬號

    集群類型

    請根據實際情況選擇ClickHouse集群的類型。

    集群ID

    選擇目標ClickHouse集群的ID。

    數據庫賬號

    填入目標ClickHouse集群的數據庫賬號。權限要求,請參見數據庫賬號的權限要求

    數據庫密碼

    填入該數據庫賬號對應的密碼。

  5. 配置完成后,在頁面下方單擊測試連接以進行下一步

    說明

    請確保DTS服務的IP地址段能夠被自動或手動添加至源庫和目標庫的安全設置中,以允許DTS服務器的訪問。更多信息,請參見添加DTS服務器的IP地址段

  6. 配置任務對象。

    1. 對象配置頁面,配置待同步的對象。

      配置

      說明

      同步類型

      僅支持全量同步 + 增量同步。預檢查完成后,DTS會將源實例中待同步對象的全量數據在目標集群中初始化,作為后續增量同步數據的基線數據。

      目標已存在表的處理模式

      • 預檢查并報錯攔截:檢查目標數據庫中是否有同名的表。如果目標數據庫中沒有同名的表,則通過該檢查項目;如果目標數據庫中有同名的表,則在預檢查階段提示錯誤,數據同步任務不會被啟動。

        說明

        如果目標庫中同名的表不方便刪除或重命名,您可以更改該表在目標庫中的名稱,請參見庫表列名映射

      • 忽略報錯并繼續執行:跳過目標數據庫中是否有同名表的檢查項。

        警告

        選擇為忽略報錯并繼續執行,可能導致數據不一致,給業務帶來風險,例如:

        • 表結構一致的情況下,如在目標庫遇到與源庫主鍵或唯一鍵的值相同的記錄:

          • 全量期間,DTS會保留目標集群中的該條記錄,即源庫中的該條記錄不會同步至目標數據庫中。

          • 增量期間,DTS不會保留目標集群中的該條記錄,即源庫中的該條記錄會覆蓋至目標數據庫中。

        • 表結構不一致的情況下,可能會導致無法初始化數據、只能同步部分列的數據或同步失敗,請謹慎操作。

      目標庫對象名稱大小寫策略

      您可以配置目標實例中同步對象的庫名、表名和列名的英文大小寫策略。默認情況下選擇DTS默認策略,您也可以選擇與源庫、目標庫默認策略保持一致。更多信息,請參見目標庫對象名稱大小寫策略

      已選擇對象

      1. 指定接收數據的數據庫。

        1. 將鼠標指針懸停在已選擇對象中待同步的Logstore,并單擊該Logstore后出現的編輯

        2. 在彈出的編輯Schema對話框中,將Schema名稱修改為目標ClickHouse集群中接收數據的數據庫名稱。

          說明

          DTS默認將Logstore的名稱映射為目標ClickHouse集群的數據庫名稱,若Logstore名稱中包含-字符,則該字符將被替換為_

        3. 單擊確定

      2. 指定接收數據的表。

        1. 單擊Table后的新增表

        2. 在彈出的添加表對話框中,配置同步對象和接收數據的表。

          同步對象的粒度支持配置為Logstore或Topic:

          • 同步粒度為Logstore:在表名文本框中,填入.*

            重要

            .*表示Logstore中的所有Topic,且僅支持將Logstore中所有Topic的數據寫入到同一張表中。

          • 同步粒度為Topic:在表名文本框中,填入Logstore中待同步的Topic名稱。

        3. 目標表名文本框中,填入目標ClickHouse集群中接收數據的表名稱。

          說明
          • 若待同步對象的粒度為Logstore,請勿單擊添加表

          • 若待同步對象的粒度為Topic,請單擊添加表,并逐一將每個Topic與ClickHouse集群中的表進行映射。

        4. 單擊確定

      3. 指定接收數據的列。

        說明

        若待同步對象的粒度為Topic,您需要重復以下操作,逐一將每個Topic與ClickHouse集群中的表進行映射。

        1. 將鼠標指針懸停在已選擇對象中剛創建的表,并單擊該表后出現的編輯

        2. 在彈出的編輯表對話框中,確定待同步的索引字段(列)。

          說明

          若您需要指定同步的索引字段,請取消選中全表同步,然后進行勾選。

        3. 目標列名文本框中,將其修改為目標表中用于接收相應索引字段數據的列名。

        4. 可選:目標類型列中,選擇對應列的數據類型。

          說明

          DTS對數據類型的默認映射,請參見數據類型映射

        5. 將每個待同步的索引字段配置完成后,單擊確認

    2. 單擊下一步高級配置,進行高級參數配置。

      配置

      說明

      選擇調度該任務的專屬集群

      DTS默認將任務調度到共享集群上,您無需選擇。若您希望任務更加穩定,可以購買專屬集群來運行DTS同步任務。更多信息,請參見什么是DTS專屬集群

      源庫、目標庫無法連接后的重試時間

      在同步任務啟動后,若源庫或目標庫連接失敗則DTS會報錯,并會立即進行持續的重試連接,默認持續重試時間為720分鐘,您也可以在取值范圍(10~1440分鐘)內自定義重試時間,建議設置30分鐘以上。如果DTS在設置的重試時間內重新連接上源庫、目標庫,同步任務將自動恢復。否則,同步任務將會失敗。

      說明
      • 針對同源或者同目標的多個DTS實例,如DTS實例A和DTS實例B,設置網絡重試時間時A設置30分鐘,B設置60分鐘,則重試時間以低的30分鐘為準。

      • 由于連接重試期間,DTS將收取任務運行費用,建議您根據業務需要自定義重試時間,或者在源和目標庫實例釋放后盡快釋放DTS實例。

      源庫、目標庫出現其他問題后的重試時間

      在同步任務啟動后,若源庫或目標庫出現非連接性的其他問題(如DDL或DML執行異常),則DTS會報錯并會立即進行持續的重試操作,默認持續重試時間為10分鐘,您也可以在取值范圍(1~1440分鐘)內自定義重試時間,建議設置10分鐘以上。如果DTS在設置的重試時間內相關操作執行成功,同步任務將自動恢復。否則,同步任務將會失敗。

      重要

      源庫、目標庫出現其他問題后的重試時間的值需要小于源庫、目標庫無法連接后的重試時間的值。

      是否限制全量遷移速率

      在全量同步階段,DTS將占用源庫和目標庫一定的讀寫資源,可能會導致數據庫的負載上升。您可以根據實際情況,選擇是否對全量同步任務進行限速設置(設置每秒查詢源庫的速率QPS每秒全量遷移的行數RPS每秒全量遷移的數據量(MB)BPS),以緩解目標庫的壓力。

      說明

      僅當同步類型選擇了全量同步時才可以配置。

      是否限制增量同步速率

      您也可以根據實際情況,選擇是否對增量同步任務進行限速設置(設置每秒增量同步的行數RPS每秒增量同步的數據量(MB)BPS),以緩解目標庫的壓力。

      環境標簽

      您可以根據實際情況,選擇用于標識實例的環境標簽。本示例無需選擇。

      配置ETL功能

      選擇是否配置ETL功能。關于ETL的更多信息,請參見什么是ETL

      監控告警

      是否設置告警,當同步失敗或延遲超過閾值后,將通知告警聯系人。

  7. 保存任務并進行預檢查。

    • 若您需要查看調用API接口配置該實例時的參數信息,請將鼠標光標移動至下一步保存任務并預檢查按鈕上,然后單擊氣泡中的預覽OpenAPI參數

    • 若您無需查看或已完成查看API參數,請單擊頁面下方的下一步保存任務并預檢查

    說明
    • 在同步作業正式啟動之前,會先進行預檢查。只有預檢查通過后,才能成功啟動同步作業。

    • 如果預檢查失敗,請單擊失敗檢查項后的查看詳情,并根據提示修復后重新進行預檢查。

    • 如果預檢查產生警告:

      • 對于不可以忽略的檢查項,請單擊失敗檢查項后的查看詳情,并根據提示修復后重新進行預檢查。

      • 對于可以忽略無需修復的檢查項,您可以依次單擊點擊確認告警詳情確認屏蔽確定重新進行預檢查,跳過告警檢查項重新進行預檢查。如果選擇屏蔽告警檢查項,可能會導致數據不一致等問題,給業務帶來風險。

  8. 購買實例。

    1. 預檢查通過率顯示為100%時,單擊下一步購買

    2. 購買頁面,選擇數據同步實例的計費方式、鏈路規格,詳細說明請參見下表。

      類別

      參數

      說明

      信息配置

      計費方式

      • 預付費(包年包月):在新建實例時支付費用。適合長期需求,價格比按量付費更實惠,且購買時長越長,折扣越多。

      • 后付費(按量付費):按小時扣費。適合短期需求,用完可立即釋放實例,節省費用。

      資源組配置

      實例所屬的資源組,默認為default resource group。更多信息,請參見什么是資源管理

      鏈路規格

      DTS為您提供了不同性能的同步規格,同步鏈路規格的不同會影響同步速率,您可以根據業務場景進行選擇。更多信息,請參見數據同步鏈路規格說明

      訂購時長

      在預付費模式下,選擇包年包月實例的時長和數量,包月可選擇1~9個月,包年可選擇1年、2年、3年和5年。

      說明

      該選項僅在付費類型為預付費時出現。

    3. 配置完成后,閱讀并勾選《數據傳輸(按量付費)服務條款》

    4. 單擊購買并啟動,并在彈出的確認對話框,單擊確定

      您可在數據同步界面查看具體任務進度。

數據類型映射

日志服務SLS

ClickHouse集群

TEXT

STRING

JSON

STRING

DOUBLE

FLOAT64

LONG

INT64