video-prompting
为视频生成模型(文本到视频和图像到视频)起草和完善提示。当用户请求“视频提示”或特定模型的提示,如Ovi、Sora、Veo 3、Wan 2.2 或 LTX-2时使用,包括诸如“文本到视频提示”、“图像到视频提示”或“为[模型]写一个提示”等请求。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
为视频生成模型(文本到视频和图像到视频)起草和完善提示。当用户请求“视频提示”或特定模型的提示,如Ovi、Sora、Veo 3、Wan 2.2 或 LTX-2时使用,包括诸如“文本到视频提示”、“图像到视频提示”或“为[模型]写一个提示”等请求。
构建能够搜索您的文档并回答问题的AI。适用于构建知识库、帮助中心问答、与文档聊天、从数据库中回答问题、内部文档搜索与回答、客户服务机器人或FAQ系统。由DSPy RAG(检索增强生成)提供支持。
专注于使用 Manim 生成动画教学视频的完整流程与专业建议。适用于用户用中文提示语让 Codex 生成脚本、分镜、Manim 代码、渲染命令或优化教学视频质量与节奏,并输出 MP4。
从原始视频片段中识别最佳剪辑,通过转录带时间戳的文本、识别高情感时刻,并为广告潜力评分。在处理创始人访谈、用户生成内容或任何原始视频以提取可用的广告组件时使用。
专家指导使用LLaMA-Factory微调大语言模型 - WebUI无代码,支持100+模型,2/3/4/5/6/8位QLoRA,多模态支持
存储和回忆顺序记忆模式及状态转换。
解析抖店商品链接,进行创作分析,并生成营销视频,返回统一结构。抖音电商平台域名为haohuo.jinritemai.com或douyin.com。
从文本中移除AI写作模式。在编辑、审阅或重写文本时使用,使文本听起来更自然、更像是人类所写。检测诸如夸张的象征手法、促销语言、破折号过度使用、AI词汇以及谄媚语气等模式。
当用户想要自动化供应链流程、构建自动化系统或实施机器人流程自动化(RPA)时。也适用于用户提到“流程自动化”、“RPA”、“工作流自动化”、“任务自动化”、“供应链机器人”、“自动补货”、“自动订购”、“自动决策”或“流程编排”的情况。对于分析仪表板,请参阅supply-chain-analytics。对于优化,请参阅optimization-modeling。
论文X光。提取论文所述内容(问题-视角-结果)以及这对lijigang意味着什么(认知差异卡片以ASCII艺术形式呈现)。当用户分享arxiv链接、论文网址、PDF或请求分析研究论文时使用。通常通过ljg-xray路由器调用。不要用于博客文章或非学术文章(应使用ljg-xray-article代替)。
从学术论文和内容生成专业的幻灯片图片。创建包含样式说明的全面大纲,自动从PDF中检测图表,然后生成单独的幻灯片图片。当用户要求“创建幻灯片”、“制作演示文稿”、“生成幻灯片集”或“幻灯片集”时使用。
平面设计主控 - 自动生成平面设计提示词,支持海报、logo、插画等多种设计类型
智能截断文本,保持内容完整性。适用于小说文本预处理、确保文本不超过指定长度限制
阅读理解故事文本,总结人物、关系、情节,整理成流畅大纲。适用于快速了解故事核心、为剧本创作提供大纲基础
「秒懂-本地版」是一个纯本地运行的AI视频摘要技能,输入视频链接或本地文件,自动生成【标题】+【摘要】+【核心要点】。基于Whisper + Qwen2.5-7B + OpenVINO加速,支持10种语言、金句提取、思维导图、社交文案、分享卡片、章节分段、竞品对比等功能。已在SkillHub获得4.8分和1100+次下载验证。100%纯本地运行,无需API Key,数据不出电脑。
使用`uvx edge-tts`进行文本转语音,将文本转换为音频。在以下情况下使用:(1) 用户通过"tts"触发词或关键词请求音频/语音输出。(2) 内容需要被朗读而非阅读(如多任务处理、无障碍需求、驾驶、烹饪等场景)。(3) 用户希望TTS输出具有特定的声音、速度、音调或格式。
使用本地的whisper.cpp将音频转录为文本。当用户想要将音频/视频转换为文本、获取转录或进行语音转文字时使用。
FDA食品安全(FSMA)、HACCP和PCQI合规的专家级AI审计员。审查食品设施记录和预防性控制措施。
游戏音频设计模式,用于创建音效和用户界面音频。在为游戏设计声音、编写AI音频提示(如ElevenLabs等)、创建反馈声音或指定能力/用户界面的音频时使用。包括来自Kind Games的心理学原则、音量层次结构、频率遮蔽预防以及针对AI音频生成的提示工程。
使用Hugging Face模型(Whisper、Wav2Vec2)构建自托管的语音转文本API,并创建LiveKit语音代理插件。在构建STT基础设施、创建自定义LiveKit插件、部署自托管转录服务或将Whisper/HF模型与LiveKit代理集成时使用。包括FastAPI服务器模板、LiveKit插件实现、模型选择指南和生产部署模式。
将研究论文复现为可运行的代码。当用户希望实现机器学习/人工智能论文、复现实验、从PDF中提取算法或将研究转化为可执行代码时使用。处理多篇相互关联的论文,具备多代理提取、方程验证和基准验证功能。
为AI UGC生成16格分镜图,并在保持角色一致性的同时使用Kling生成视频。通过“创建分镜图”和“生成故事板”来启动。
帮助品牌市场、广告创意、平面设计和社交媒体运营团队直接完成“GPT Image 2 营销图片”:既可从文字生成,也可加入参考图帮助控制主体、构图和视觉风格;通过 AI Hive 使用时,生成前自动上传参考图,提交后自动保存任务、查询进度并下载图片。适用于电商主图、商品详情页、广告 KV、海报、带货、种草、社媒配图、产品精修、换背景与角色一致性内容。 Use this skill for GPT I…
从指定的新闻网站查找用户的最新新闻。提供政治、财经、社会、世界、科技、体育和娱乐的权威网址。使用browser_use打开每个网址并使用snapshot获取内容,然后为用户总结。