SkillsLib.ai

Analytics Documentation Generator

Auto-generate data dictionaries, lineage maps, and transformation docs from your analytics stack

0.0(0 reviews)
10+ downloads
Updated Sep 2026

What You Can Do

This skill automatically documents your entire analytics infrastructure by analyzing data sources, transformations, and outputs. You'll generate production-ready data dictionaries with field definitions, lineage maps showing data flow across systems, and transformation documentation that explains logic and dependencies. Save weeks of manual documentation work while keeping your analytics stack discoverable as it evolves.

Features

Data dictionary generation

automatically catalog all tables, fields, data types, and business definitions from your warehouse

Lineage mapping

trace data flow from source systems through transformations to final analytics outputs

Transformation documentation

auto-generate docs explaining ETL logic, filters, aggregations, and dependencies

Column-level metadata extraction

capture field descriptions, constraints, quality rules, and ownership

Impact analysis

identify downstream dependencies when source schemas or transformations change

Markdown export

generate version-control-friendly documentation that lives alongside your code

Platform integration templates

pre-built connectors for Snowflake, BigQuery, Redshift, dbt, and Fivetran

Business glossary generation

automatically organize and cross-reference business term definitions across your stack

Example Output

Example Data Dictionary Entry

Table: customers_fact Owner: Analytics Team Updated: 2026-07-30

ColumnTypeDescriptionBusiness Definition
customer_idINTUnique customer identifier (PK)Stable identifier for each customer
emailVARCHARCustomer email addressPrimary communication channel
lifetime_valueDECIMAL(12,2)Total customer spend (USD)Sum of all successful transactions

Example Lineage Map

code
salesforce_accounts → Fivetran → raw_salesforce → dbt models → 
  dim_accounts → Revenue Dashboard
          ↓
  fact_opportunities → Sales Pipeline Report

Example Transformation Doc

Transformation: stg_orders__deduplicated

  • Source: raw_orders table
  • Logic: Deduplicates orders by order_id, keeping latest updated_at timestamp
  • Dependencies: Runs after raw_orders is refreshed, upstream of fct_orders
  • Last updated: 2026-07-15
  • Owner: analytics@company.com

What's Included

  • SKILL.md: Complete analytics documentation generation workflow with decision trees
  • Data Dictionary Template: Structured markdown template for table and column documentation
  • Lineage Map Template: Mermaid-formatted data flow diagrams
  • Transformation Documentation Template: ETL logic and dependency tracking
  • Column Metadata Extraction Checklist: Step-by-step field cataloging guide
  • Platform Integration Guide: Connection setup for Snowflake, BigQuery, Redshift, dbt Cloud, and Fivetran
  • Schema Change Impact Analysis Workflow: Identify affected downstream transforms
  • Business Glossary Builder: Automated term extraction and cross-reference guide
  • Documentation Audit Checklist: Quality assurance for generated docs

Who It's For

  • Data Engineers building and maintaining ETL pipelines across multiple source systems
  • Analytics Engineers documenting dbt transformations and maintaining semantic layers
  • Data Analysts onboarding to new analytics environments or inheriting legacy systems
  • Data Governance Managers building metadata catalogs and compliance frameworks
  • Business Intelligence Developers creating self-service analytics platforms and BI portals

Best For

  • Documenting legacy analytics systems with missing or outdated metadata
  • Creating data dictionaries for compliance (HIPAA, GDPR, SOX audits)
  • Onboarding new team members to your analytics stack quickly
  • Building data governance and cataloging frameworks from scratch
  • Tracking schema changes and impact analysis across your entire data platform

You might also like

BI Data Quality Investigator
$30
BI Data Quality Investigator

You'll systematically diagnose data quality problems by developing structured root cause analysis frameworks, calculating the true business impact, and creating reproducible validation tests. This skill walks you through hypothesis-driven investigation, data lineage analysis, and remediation planning — turning data issues into documented fixes and preventive measures.

Data Quality Test Framework Builder
$35
Data Quality Test Framework Builder

You'll build comprehensive data quality test suites that validate transformations, detect anomalies, and document standards across your dbt and SQL pipelines. This skill generates production-ready test configurations, anomaly detection protocols, and validation rules that catch data issues before they impact analytics.

Model Evaluation Suite
$30
Model Evaluation Suite

You can design multi-dimensional evaluation strategies tailored to your model's specific capabilities and use cases, create representative test sets that expose edge cases and failure modes, implement automated scoring mechanisms for reproducible results, and generate benchmark comparison reports that contextualize performance within industry standards. This skill transforms ad-hoc testing into systematic, evidence-based model assessment—essential for production deployment decisions and ongoing performance monitoring.

Analytics Report Builder: Executive-Ready Data Storytelling
$40
Analytics Report Builder: Executive-Ready Data Storytelling

You can convert complex datasets and business metrics into polished, executive-ready reports that stakeholders trust and act on. Claude generates data-driven narratives, executive summaries, actionable insights, and visualization recommendations tailored to your audience's priorities. Your reports will tell a cohesive story that connects metrics to business outcomes, eliminating confusion and accelerating decision-making.

Fine-Tuning Dataset Preparation & Validation for Claude
$45
Fine-Tuning Dataset Preparation & Validation for Claude

This skill walks you through the complete dataset preparation workflow for fine-tuning Claude models. You'll validate training data quality, detect and fix formatting errors, identify data imbalances, and generate validation reports to ensure your fine-tuned model performs reliably in production.

Claude Fine-Tuning Optimization
$30
Claude Fine-Tuning Optimization

This skill provides a systematic framework for preparing training data, benchmarking model performance, identifying deployment risks, and calculating true ROI before committing fine-tuning investments. You'll validate datasets, run structured evaluations against baseline Claude models, test edge cases, and iterate toward production-ready fine-tuned versions. The framework ensures your fine-tuned models deliver meaningful improvements while maintaining safety and cost-effectiveness.

ML Model Evaluation & Debugging
$40
ML Model Evaluation & Debugging

Diagnose root causes of model performance failures, select optimal evaluation metrics based on your use case and data characteristics, and design comprehensive evaluation strategies. You'll get systematic workflows for analyzing failure modes, statistical significance testing, threshold optimization, and cross-validation planning—turning vague model problems into actionable fixes.

Agentdb Vector Search
$20
RAG4.1(34)
Agentdb Vector Search

You can build production-grade vector search systems that retrieve semantically similar documents in sub-millisecond time using AgentDB's optimized HNSW indexing. The skill enables you to implement RAG pipelines, semantic search engines, and intelligent knowledge bases with configurable embedding dimensions, distance metrics (cosine, Euclidean, dot product), and similarity thresholds—all with built-in quantization and caching for massive performance gains.

$25.00