数据科学 Skill技能列表

KafkaStreamsSkill kafka-streams

4.5

Kafka Streams是一个用于构建实时流处理应用程序的库,它提供了一个高级的抽象,允许开发者轻松地表达处理逻辑,同时确保数据的容错性和可扩展性。

Seaborn统计可视化Skill seaborn

4.5

Seaborn 是一个用于创建高质量统计图形的 Python 数据可视化库,支持散点图、箱线图、热力图等多种图表类型,适用于数据探索、分析和出版物制作。关键词:Python 可视化、统计图形、数据分析、数据探索、Seaborn 库、数据可视化工具。

ApacheBeam核心概念技能Skill beam-concepts

4.5

Apache Beam是一个用于批处理和流数据处理的开源编程模型,支持构建可移植的数据管道,适用于数据工程、ETL开发和云原生应用。关键词:数据处理、批处理、流处理、Apache Beam、数据管道、数据工程、ETL开发、云原生。

PDF处理Skill pdf

4.5

PDF处理技能是一种使用Python库和工具进行PDF文档操作的技能,包括文本提取、表格提取、PDF创建、合并、分割、表单处理、OCR等。适用于数据提取、文档自动化、数据预处理等场景。关键词:PDF处理、文本提取、表格提取、OCR、Python、数据工程、文档自动化、PDF库。

Postgresql技能Skill postgresql

4.5

全面协助PostgreSQL开发,由官方文档生成。

JSON与CSV数据转换Skill json-and-csv-data-transformation

4.5

这个技能用于在JSON、CSV等数据格式之间进行转换,支持过滤、提取、映射、扁平化嵌套结构和聚合操作。适用于数据处理工作流,如API响应处理、ETL流程、数据清洗和报表生成,提升数据分析和集成效率。关键词:JSON转换, CSV转换, 数据过滤, 数据扁平化, ETL, 数据处理, 数据工程, API集成。

数据可视化信息图生成器Skill data-viz-gen

4.5

从JSON数据一键生成自包含的HTML/SVG信息图,支持统计卡片、分组柱状图、流程图和混合仪表盘四种类型,内置8套专业配色和24个图标,输出文件无需外部依赖,适用于数据报告、产品看板、流程说明等场景。当用户需要数据可视化、信息图、图表、仪表盘,或提及生成图表、制作dashboard、展示统计数据等请求时触发。

无梯度优化Skill derivative-free-optimization

4.5

无梯度优化是一种数学优化技术,用于在目标函数的梯度信息不可用、难以计算或不可靠的情况下寻找最优解。它通过直接评估函数值来探索参数空间,适用于黑盒函数优化、实验设计、参数调优等场景。主要方法包括Nelder-Mead单纯形法、Powell方法、贝叶斯优化和模式搜索等。关键词:无梯度优化,黑盒优化,贝叶斯优化,参数调优,数学优化,代理模型,Nelder-Mead,Powell方法,模式搜索,信赖域方法。

Starlake配置技能(完整参考)Skill config

4.5

这个技能提供了Starlake数据管道配置的完整参考指南,涵盖环境变量配置、JSON模式验证、生产最佳实践等,适用于数据工程师、ETL开发人员和数据架构师,帮助构建高效的数据处理流程。关键词:Starlake,数据工程,ETL,配置,YAML,JSON模式,数据管道,最佳实践。

自动加载Skill autoload

4.5

自动加载技能通过监控传入目录,自动推断数据文件的模式,生成配置文件,并将数据高效加载到数据仓库中,适用于快速数据集成和ETL流程优化,关键词包括:自动加载、模式推断、数据仓库、ETL、数据工程。

预测市场技能Skill markets

4.5

此技能用于搜索和比较预测市场数据,支持Polymarket、Kalshi、Manifold和Metaculus等平台,提供实时价格和订单簿信息,帮助用户进行市场分析和投资决策。关键词:预测市场、数据搜索、价格查看、平台比较、量化金融、市场分析、SEO优化。

参考类预测Skill reference-class-forecasting

4.5

参考类预测是一种统计预测技能,通过识别相似历史事件的类别,使用其统计频率作为基线预测。它用于避免主观偏见,建立客观预测基准,适用于金融评估、项目预测、决策分析等场景。关键词:预测建模、统计基线、参考类、外部视角、避免偏见、历史数据、量化评估。