Art
完整的视觉内容系统。当用户想要创建视觉内容、插图、图表,或提到艺术、标题图片、可视化、美人鱼图、流程图、技术图解、信息图、PAI图标、包图标或PAI包图标时使用。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
完整的视觉内容系统。当用户想要创建视觉内容、插图、图表,或提到艺术、标题图片、可视化、美人鱼图、流程图、技术图解、信息图、PAI图标、包图标或PAI包图标时使用。
全面的CrewAI框架指南,用于构建协作式AI代理团队和结构化工作流程。在使用CrewAI开发多代理系统、创建自主AI团队、编排流程、实现具有角色和工具的代理或构建可用于生产的AI自动化时使用。对于构建智能代理系统、任务自动化和复杂AI工作流的开发者来说是必不可少的。
使用Pollinations.ai生成AI图像,如果失败则使用Stable Horde作为备选 - 完全免费且无需API密钥。适用于生成网站和应用程序所需的英雄图像、图标、徽标、插图、模型或任何视觉资产。涵盖具有专业质量的产品照片、头像、占位符以及社交媒体图像。
高性能 RAG 多路检索服务。集成 Milvus 向量数据库进行语义检索,并结合 Rerank 模型进行精准重排序,支持海量文档的高效存储与历史内容召回。
Claude Computer Use - 通过截屏+视觉理解操作任意桌面应用(精确坐标点击/滚动/拖拽/键盘/右键/双击)。终极后备方案,当 peekaboo/pywinauto/browser 无法满足时使用。
用于控制节奏和动态难度的AI导演技能
使用Gemini 3 Pro处理多模态输入(图像、视频、音频、PDF)。涵盖图像理解、视频分析、音频处理、文档提取、媒体分辨率控制、OCR和令牌优化。在分析图像、处理视频、转录音频、提取PDF内容或处理多模态数据时使用。
RAG聊天机器人的详细信息,包括用户界面和后端逻辑。
当用户请求跨多个问题的自主操作时使用。协调并行工作人员,监控进度,处理SLEEP/WAKE周期,并在无需用户干预的情况下工作直到完成整个范围。
**下载视频或音频**。自动识别 URL 下载 YouTube, Bilibili, Twitter, TikTok 等平台的媒体。
专业插画师,精通图像生成脚本、图像转换工具和版面设计。在创建视觉素材、生成特定风格的图像、转换图像格式、排版或设计视觉构图时使用。
提供关于Spring AI Alibaba的全面指导,包括阿里云AI服务集成、模型API以及AI应用开发。当用户询问关于Spring AI Alibaba的信息、需要使用阿里云AI服务或在Spring应用中集成AI功能时,请参考此指南。
给视频烧录字幕。支持从本地视频自动提取文字稿(FunASR 词级时间轴),也支持手动提供 LRC/ASS 字幕文件。语种自动识别,中文字幕自动启用中英双语模式。支持目录批量处理。6种系统字体 + 本地fonts/目录自动发现,字体偏好自动记忆,6种颜色。触发词:视频加字幕、添加字幕、烧录字幕、给视频配字幕、加字幕、字幕烧录、生成字幕视频、批量加字幕、批量烧录、目录加字幕。
设备端翻译:翻译框架、系统翻译表、TranslationSession API、语言检测。在添加文本翻译、语言切换或设备端机器学习翻译功能时使用。触发条件:Translation、TranslationSession、translate、language、translationTask。
使用LigandMPNN进行配体感知的蛋白质序列设计。在以下情况下使用此技能:(1)围绕小分子设计序列,(2)酶活性位点设计,(3)配体结合口袋优化,(4)金属配位位点设计,(5)辅因子结合蛋白设计。对于标准蛋白质设计,请使用proteinmpnn。对于溶解度优化,请使用solublempnn。
智谱AI的视觉语言模型,用于图像分析、内容识别和视觉问答
视觉艺术和静态设计创作。输出:.png、.pdf文档。功能:海报设计、信息图表、视觉艺术、设计理念创作、构图、布局。操作:创建、设计、构图、生成海报/艺术/信息图表。关键词:海报、信息图表、视觉艺术、画布、构图、布局、PDF设计、PNG创建、图形设计、视觉层次、设计理念、美学运动、静态设计、可打印、艺术品。使用场合:创建海报、设计信息图表、生成视觉艺术、制作静态设计、生产可打印材料、以视觉方式表达…
创建个性化的锻炼计划并提供运动指导
地图投影技能
将抽象/隐喻性的叙述转化为具体的视觉故事结构。使用场景:当需要将诗歌/戏剧性叙述从多样内容生成转换为逐场视觉分解,以便进行编剧格式化时。管道位置:多样内容生成 → **叙述者** → 编剧 → 生产验证者 → 想象 → 存档-验证 主要功能:在“私人祭坛”(抽象隐喻)与“女子每天回到同一个海滩地点”(可拍摄场景)之间架起桥梁。输出:具有具体视觉动作、保留情感核心及故事逻辑文档的场景分解。
形式逻辑推理和论证验证的技能
从任何内容(书籍、文章、主题、笔记、对话)生成Obsidian MarkMind富格式思维导图。每当用户要求创建思维导图、心智图、概念图或视觉摘要时,使用此技能。当用户说'markmind'、'mindmap'、'mind map'、'mappa',或者要求可视化/映射/概要化任何内容时也触发该技能。该技能处理头脑风暴、内容提取、层级设计,并输出一个.md文件,准备好粘贴到带有MarkMind插件…
为LLM应用程序构建基于向量数据库和语义搜索的检索增强生成(RAG)系统。在实现基于知识的AI、构建文档问答系统或将大型语言模型与外部知识库集成时使用。
记忆是智能代理的基石。没有它,每次交互都从零开始。这项技能涵盖了代理记忆的架构:短期(上下文窗口)、长期(向量存储)以及组织它们的认知架构。关键见解:记忆不仅仅是存储——它是检索。如果找不到正确的信息,存储的一百万个事实毫无意义。分块、嵌入和检索策略决定了你的代理是否记得或忘记。该领域是零碎的