从 PDF 提取高质量图片资源
从 PDF 文件中提取高清整页大图以及无损的原始内嵌图像素材(如 Logo、系统截图),并通过 AI 清洗后生成标准的 assets_manifest.json 供下游使用。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
从 PDF 文件中提取高清整页大图以及无损的原始内嵌图像素材(如 Logo、系统截图),并通过 AI 清洗后生成标准的 assets_manifest.json 供下游使用。
分析故事文本,提炼主要情节点并分析戏剧功能。适用于分析小说、剧本大纲、故事梗概等文本,识别关键转折点和情感节点
ASR(自动语音识别)——基于豆瓣大模型构建的增强型语音转文字功能,具有音频预处理、降噪和扩展分析能力。异步API。选择此技能时:- 输入为视频文件(mp4/mov/mkv)——自动提取音轨- 识别前需要对音频进行降噪- 文件超过512MB或5小时(无大小限制)- 音频源为TOS内部路径(tos://bucket/key)- 需要带有时间戳的语句和元数据的结构化JSON输出- 需要说话人分割、情绪…
帮助内容创作者、IP 与角色设计团队、种草博主和视觉策划直接完成“GPT Image 2 角色一致性图片”:上传一张现有图片并说明要保留和改变的内容,就能完成重绘、精修或风格调整;通过 AI Hive 使用时,生成前自动上传参考图,提交后自动保存任务、查询进度并下载图片。适用于电商主图、商品详情页、广告 KV、海报、带货、种草、社媒配图、产品精修、换背景与角色一致性内容。 Use this ski…
根据文本提示使用豆包SeeDream API生成图片。当用户请求AI生成的图片、艺术作品、插图或视觉内容创作时,请使用此技能。该技能处理API调用,将生成的图片下载到项目的/pic文件夹中,并支持最多连续生成4张图片。
查找超过550个中文电影、摄影和制作术语及其英文对应词,以及适用于Seedance 2.0的提示短语,涵盖22个类别,包括动作、武器和战斗相关的过滤安全词汇。在用普通话撰写提示、将制作概念翻译成中文Seedance词汇或验证术语准确性时使用。
当用户明确要求"优化 prompt"、"改进提示词"、"润色指令"或"将简陋 prompt 转换为最佳实践版本"时使用。基于 OpenAI 和 Anthropic 官方最佳实践,对用户提供的简陋 prompt 进行结构化优化,输出符合社区标准的高质量版本。
数据分析师。支持pandas、numpy、可视化和统计分析。
使用Python/matplotlib生成具有统一figures4papers样式、适合出版的科学图表。在创建或优化学术条形图/趋势图/热力图/散点图/多面板图表,强制视觉一致性,或导出适合论文的PNG/PDF/SVG格式输出时使用。
高精度光学字符识别(OCR)服务。支持多语言、多格式图像的文字检测与提取,并提供文本区域坐标与置信度评分,适用于文档数字化与图像内容分析。
生成、合成并编辑产品图、品牌视觉、海报、社交媒体配图、插画和照片的不同版本。
帮助电商运营、商品摄影、品牌商品团队和直播带货团队直接完成“Nano Banana 2 商品详情页”:既可从文字生成,也可加入参考图帮助控制主体、构图和视觉风格;通过 AI Hive 使用时,生成前自动上传参考图,提交后自动保存任务、查询进度并下载图片。适用于电商主图、商品详情页、广告 KV、海报、带货、种草、社媒配图、产品精修、换背景与角色一致性内容。 Use this skill for Na…
使用AgentDB的150倍更快的向量数据库实现ReasoningBank自适应学习。包括轨迹跟踪、判决判断、记忆提炼和模式识别。在构建自学习代理、优化决策或实现经验回放系统时使用。
搜索语言,例如 zh-CN、en-US
在选择AI模型、配置API参数或实现LLM调用时使用。涵盖OpenAI(GPT-5.2、GPT-5.1、GPT-4.1、o3)、Anthropic(Claude 4.5)、Google(Gemini 2.5/3)、DeepSeek(V3.2、R1)以及带有规格说明、注意事项和代码模板的嵌入模型。
阅读理解小说文本,总结成流畅的故事大纲。适用于小说初筛选、生成500-800字故事大纲
YouTube 视频智能剪辑工具。下载视频和字幕,AI 分析生成精细章节(几分钟级别),用户选择片段后自动剪辑、翻译字幕为中英双语、烧录字幕到视频,并生成总结文案。使用场景:当用户需要剪辑 YouTube 视频、生成短视频片段、制作双语字幕版本时。关键词:视频剪辑、YouTube、字幕翻译、双语字幕、视频下载、clip video
研究最新的ComfyUI模型、技术和社区发现。监控YouTube频道、GitHub仓库和HuggingFace。用带有时间戳的发现更新参考文件,并标记过时信息。可以通过/research comfyui命令调用,或在会话开始时自动进行过时性检查。
全能音乐创作助手——交互式选曲风格(说唱、R&B、儿歌、流行、摇滚、电 子、爵士、古典、民谣、鬼畜音MAD等40+子风格),从歌词创作到HappyShrimp风格提示词 一站式输出。支持中文/英文/双语/日语。当用户要求写歌曲、创作音乐、做儿歌、写Rap、R&B、流行歌曲、编曲、作曲、鬼畜、音MAD时使用。
RNN+Transformer混合模型,具有O(n)推理。线性时间,无限上下文,无KV缓存。像GPT一样并行训练,像RNN一样顺序推理。Linux基金会AI项目。在Windows、Office、NeMo中投入生产。RWKV-7(2025年3月)。模型参数高达140亿。
将包含解说和字幕的PPT/幻灯片转换为视频。从PPTX文件或slides.json中提取/渲染幻灯片图像,通过TTS生成解说,并添加字幕以创建最终的MP4视频。适用于“将PPT转为视频”,“生成演讲视频”,“制作含字幕视频”等请求。
科研炼金术士,生物医学专家与科研叙事。分析科研图表、结合 PubMed 等文献生成深度叙事。需配合 MCP 工具;用于论文图表解读、讨论升华与文献增强。
深度分析单篇论文,生成详细笔记和评估,图文并茂
帮助品牌市场、广告创意、平面设计和社交媒体运营团队直接完成“Nano Banana Pro 精准文字图片”:既可从文字生成,也可加入参考图帮助控制主体、构图和视觉风格;通过 AI Hive 使用时,生成前自动上传参考图,提交后自动保存任务、查询进度并下载图片。适用于电商主图、商品详情页、广告 KV、海报、带货、种草、社媒配图、产品精修、换背景与角色一致性内容。 Use this skill for…