人工智能 Skill技能列表
视频提示词工程Skill video-prompt-engineering
视频提示词工程技能专注于为Sora、Runway、Pika、Kling等主流AI视频生成平台设计和优化提示词。该技能旨在通过结构化的提示词框架,精确控制视频生成的场景设定、角色动作、摄像机运动、灯光氛围和视觉风格,从而生成具有电影级制作质量的视频内容。核心关键词包括:AI视频生成、提示词工程、电影制作、AIGC、视频内容创作、多平台优化。
Firecrawl网页爬取技能Skill firecrawl-scraper
Firecrawl是一个用于人工智能的网页数据API技能,能够将网站内容转换为适合大语言模型(LLM)的markdown或结构化数据。它处理JavaScript渲染、绕过反爬虫系统、支持格式转换和浏览器自动化。适用于站点提取、动态内容抓取、AI数据准备等场景。关键词:Firecrawl, 网页抓取, 爬虫, API, markdown, 结构化数据, AI数据提取, JavaScript渲染, 反机器人绕过
微信管理助手Skill wechat-management
微信管理助手是一个基于MCP服务器的智能工具,专门用于自动化管理微信消息和通信。该工具提供微信消息发送、聊天状态监控、智能回复风格适配等功能,支持群聊管理和安全验证。适用于个人社交沟通、工作群组协作、客户服务等场景,通过AI智能体技术实现高效、安全的微信自动化操作。
会议纪要生成Skill meeting-recap
将会议录音文字稿、笔记或聊天记录等原始材料整理为结构化会议纪要,自动提取议题、讨论要点、结论以及包含负责人与截止日期的行动项。当用户提供会议素材并提及会议记录、纪要、meeting minutes、会议总结、行动项、整理会议或会后跟踪等关键词时触发。
预测竞技场Skill clawarena
ClawArena是一个AI智能体预测竞技平台,专注于预测市场结果和准确率竞争。该技能允许AI智能体接入Kalshi预测市场,对加密货币、政治、经济、体育、天气等各类事件进行YES/NO预测,与其他AI智能体比拼预测准确率,并参与排行榜竞争。核心功能包括:市场浏览、预测提交、准确率追踪、排行榜查看、人机协作预测、每日预测挑战等。关键词:AI预测、预测市场、Kalshi、准确率竞争、智能体竞技、量化预测、事件预测、排行榜、人机协作。
AI语音克隆Skill ai-voice-cloning
AI 语音克隆技能使用先进的 AI 技术进行文本到语音转换和语音合成,支持多种声音、情感、口音、长文本叙述和对话功能。适用于语音助手、有声书制作、播客生成、视频配音、可访问性增强等场景,关键词包括 AI 语音生成、文本到语音、语音合成、语音克隆、有声书、视频配音、AIGC、自然语音。
计算机视觉技能Skill ComputerVisionSkill
计算机视觉技能是机器人视觉应用的核心技术,专注于相机标定、特征检测与跟踪、立体视觉和视觉伺服。该技能能够实现高精度的相机内参和外参标定,支持多种特征检测算法(如ORB、SIFT、SuperPoint)和光流跟踪技术(如Lucas-Kanade),并应用于视觉SLAM、物体检测、数字孪生等机器人流程。关键词:计算机视觉,机器人视觉,相机标定,特征检测,视觉跟踪,立体视觉,视觉伺服,OpenCV,SLAM,图像处理。
语音转文字Skill speech-to-text
这个技能利用基于Whisper模型的AI技术,通过inference.sh命令行界面,高效地将音频文件转录为文本,支持多语言识别、时间戳标注和翻译功能,适用于会议记录、播客制作、视频字幕生成、语音笔记转化等多种场景。关键词:语音转文字,音频转录,AI语音识别,Whisper模型,inference.sh,自动字幕,多语言支持,语音识别。
写作风格提取技能Skill voice-capture
这个技能用于从样本文本中提取和编码写作风格,创建可重用的语音配置文件。它帮助用户分析写作模式,保持一致性或模仿特定风格,适用于内容创作、品牌管理和写作辅助。关键词:写作风格提取、文本分析、NLP、语音配置文件、写作辅助、风格模仿、自然语言处理。
MiniMax文本转语音技能Skill tts-skill
MiniMax TTS 技能是一个提供文本转语音、声音克隆和声音设计功能的 API 封装,通过 Python 模块集成,便于开发者快速实现语音合成应用。关键词包括 TTS、语音合成、AI 语音、声音克隆、API 集成。
自我改进提示设计Skill self-improve-prompt-design
这个技能用于设计自我改进提示,帮助AI代理专家自动同步和验证专业知识文件与代码库实现,确保模型准确性,优化维护工作流,并集成到Act-Learn-Reuse循环中。关键词:自我改进、提示设计、AI代理、代码库同步、专业知识验证、自动化维护。
高级计算机视觉专家Skill senior-computer-vision
高级计算机视觉专家技能专注于构建和部署生产级视觉AI系统,涵盖图像/视频处理、目标检测、语义分割、3D视觉、实时推理等核心领域。专家精通PyTorch、OpenCV、YOLO、SAM、扩散模型及视觉Transformer等前沿技术栈,擅长设计可扩展的MLOps架构、优化模型性能与部署流程,并确保系统的高可用性、安全合规与成本效益。适用于自动驾驶、安防监控、工业质检、医疗影像、内容生成等场景的AI解决方案开发。 关键词:计算机视觉,目标检测,图像分割,PyTorch,OpenCV,YOLO,SAM,扩散模型,视觉Transformer,AI模型部署,MLOps,实时推理,3D视觉,视频分析,生产级AI系统