SKILL.md
唯讀
名稱
data-analytics
描述
使用 PlantUML 語法與資料庫/分析圖示圖章(stencil icons),繪製資料管道(data pipeline)與分析架構圖。最適合 ETL 流程管道、資料湖(data lake)、即時串流(real-time streaming)、資料倉儲(data warehousing)及 BI 儀表板設計。
資料分析架構圖產生器
快速入門: 定義資料源 → 宣告擷取/ETL 圖示 → 連接至儲存區/資料倉儲 → 新增 BI/視覺化 → 包裹在 ```plantuml 程式碼圍欄中。
⚠️ 重要: 請務必使用
```plantuml或```puml程式碼圍欄。切勿使用```text— 否則將無法繪製為架構圖。
關鍵規則
- 所有圖表皆以
@startuml開頭,並以@enduml結尾 - 資料管道請使用
left to right direction轉向(來源 → 擷取 → 轉換 → 儲存 → 視覺化) - 分析、資料庫與儲存區圖示請使用
mxgraph.aws4.*圖章語法 - 系統會自動套用預設顏色 — 您不需要指定
fillColor或strokeColor - 使用
rectangle "Zone" { ... }或package "Layer" { ... }劃分管道階段群組 - 定向流向使用
-->,非同步/串流流向使用..>(虛線)
完整圖章參考: 請參閱 stencils/README.md 查看超過 9,500 個可用圖示。
Mxgraph 圖章語法
mxgraph.aws4.<icon> "Label" as <alias>
分析與 ETL 圖章
| 分類 | 圖章 | 用途 |
|---|---|---|
| 查詢引擎 | athena, athena_data_source_connectors |
針對 S3 資料的無伺服器 SQL 查詢 |
| ETL | glue, glue_crawlers, glue_data_catalog, aws_glue_data_quality, aws_glue_for_ray |
資料整合與目錄建置 |
| 串流 | kinesis, kinesis_data_streams, kinesis_data_firehose, kinesis_data_analytics, kinesis_video_streams |
即時資料串流 |
| MapReduce | emr, emr_engine, emr_engine_mapr_m3, emr_engine_mapr_m5 |
大數據處理(Spark、Hive) |
| 資料倉儲 | redshift, redshift_ra3, redshift_streaming_ingestion, redshift_ml |
欄式分析資料倉儲 |
| 搜尋 | opensearch_service_data_node, opensearch_ingestion, cloudsearch |
全文檢索與日誌分析 |
| BI | quicksight |
儀表板與視覺化 |
| 資料湖 | lake_formation, s3, glacier, glacier_deep_archive |
受控的資料湖儲存 |
| 資料目錄 | datazone_custom_asset_type, data_exchange |
資料治理與共享 |
| Kafka 串流 | msk, msk_connect |
代管式 Kafka 串流 |
資料庫圖章
| 分類 | 圖章 | 用途 |
|---|---|---|
| 關聯式 | aurora, aurora_instance, rds, rds_instance, rds_mysql_instance, rds_postgresql_instance |
交易型資料庫 |
| NoSQL | dynamodb, dynamodb_table, dynamodb_global_secondary_index, dynamodb_stream |
鍵值與文件儲存庫 |
| 圖形 | neptune |
圖型資料庫 |
| 記憶體內 | elasticache, elasticache_for_redis, elasticache_for_memcached |
快取與 Session 儲存 |
| 文件 | documentdb, documentdb_with_mongodb_compatibility |
文件資料庫 |
| 帳本 | quantum_ledger_database |
不可變變動交易紀錄 |
| 寬欄 | keyspaces |
相容於 Cassandra |
連線類型
| 語法 | 意義 | 使用場景 |
|---|---|---|
A --> B |
實線箭頭 | 批次資料流/API 呼叫 |
A ..> B |
虛線箭頭 | 串流/非同步/CDC |
A -- B |
實線 | 雙向同步 |
A --> B : "label" |
具標籤連線 | 描述資料格式或資料量 |
快速範例
@startuml
left to right direction
mxgraph.aws4.s3 "Data Lake\n(S3)" as s3
mxgraph.aws4.glue "Glue\nETL" as glue
mxgraph.aws4.redshift "Redshift" as rs
mxgraph.aws4.quicksight "QuickSight" as qs
s3 --> glue
glue --> rs
rs --> qs
@enduml
資料分析架構類型
| 類型 | 用途 | 關鍵圖章 | 範例 |
|---|---|---|---|
| 資料湖 | 集中式原始資料儲存 | s3, lake_formation, glue, athena |
data-lake.md |
| 即時串流 | 事件串流處理 | kinesis, msk, lambda_function, opensearch_service |
real-time-streaming.md |
| 資料倉儲 | 星狀結構(Star-schema)分析 | redshift, glue, quicksight |
data-warehouse.md |
| ETL 管道 | 擷取、轉換、載入 (Extract-Transform-Load) | glue, glue_crawlers, glue_data_catalog, s3 |
etl-pipeline.md |
| 日誌分析 | 集中式日誌管理 | kinesis_data_firehose, opensearch_service, lambda_function |
log-analytics.md |
| 機器學習特徵庫 | 特徵工程流程管道 | glue, s3, athena, emr |
ml-feature-pipeline.md |
| CDC 管道 | 資料庫變更資料擷取 (Change Data Capture) | dynamodb_streams, kinesis, lambda_function, redshift |
cdc-pipeline.md |
| 多來源 BI | 跨資料庫報表分析 | aurora, dynamodb, redshift, quicksight |
multi-source-bi.md |




