jimeng_mcp_skill
使用jimeng-mcp-server进行AI图像和视频生成。当用户请求从文本生成图像、合成多张图片、从文本描述创建视频或为静态图像添加动画时使用此技能。支持四大核心能力:文生图、图像合成、文生视频、图生视频。需要jimeng-mcp-server在本地运行或通过SSE/HTTP访问。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
使用jimeng-mcp-server进行AI图像和视频生成。当用户请求从文本生成图像、合成多张图片、从文本描述创建视频或为静态图像添加动画时使用此技能。支持四大核心能力:文生图、图像合成、文生视频、图生视频。需要jimeng-mcp-server在本地运行或通过SSE/HTTP访问。
视频和音频的感知、索引和编辑。接收文件/URL/直播流,构建视觉/口语索引,使用时间戳搜索,编辑时间线,添加叠加/字幕,生成媒体,并创建实时警报。
使用Oracle的开放代理规范设计与框架无关的AI代理,以JSON/YAML定义实现可移植、互操作的代理系统
从 PDF 文件中提取高清整页大图以及无损的原始内嵌图像素材(如 Logo、系统截图),并通过 AI 清洗后生成标准的 assets_manifest.json 供下游使用。
分析故事文本,提炼主要情节点并分析戏剧功能。适用于分析小说、剧本大纲、故事梗概等文本,识别关键转折点和情感节点
ASR(自动语音识别)——基于豆瓣大模型构建的增强型语音转文字功能,具有音频预处理、降噪和扩展分析能力。异步API。选择此技能时:- 输入为视频文件(mp4/mov/mkv)——自动提取音轨- 识别前需要对音频进行降噪- 文件超过512MB或5小时(无大小限制)- 音频源为TOS内部路径(tos://bucket/key)- 需要带有时间戳的语句和元数据的结构化JSON输出- 需要说话人分割、情绪…
使用AgentDB的150倍更快的向量数据库实现ReasoningBank自适应学习。包括轨迹跟踪、判决判断、记忆提炼和模式识别。在构建自学习代理、优化决策或实现经验回放系统时使用。
搜索语言,例如 zh-CN、en-US
【深度调研专用】当需要系统性调研、多产品对比、深度分析、技术选型、趋势分析时必须使用本技能。触发关键词:调研、对比、分析、评估、选型、趋势、综合报告、多源验证。通过 3 层深度搜索(阅读多个网页)+ 多源交叉验证,提供比普通 WebSearch 更全面、更准确的研究结果和深度洞察。禁止用普通搜索工具替代深度调研任务。
由AI驱动的原子习惯追踪器,具备自然语言记录、连续天数追踪、智能提醒和指导功能。可用于创建习惯、自然地记录完成情况(如“我今天冥想了”)、查看进度以及获得个性化指导。
即时搜索超过100万张高质量的人工智能生成的库存图片。每日更新。为任何项目找到合适的图片 - 无需API密钥。
使用Python/matplotlib生成具有统一figures4papers样式、适合出版的科学图表。在创建或优化学术条形图/趋势图/热力图/散点图/多面板图表,强制视觉一致性,或导出适合论文的PNG/PDF/SVG格式输出时使用。
高精度光学字符识别(OCR)服务。支持多语言、多格式图像的文字检测与提取,并提供文本区域坐标与置信度评分,适用于文档数字化与图像内容分析。
RNN+Transformer混合模型,具有O(n)推理。线性时间,无限上下文,无KV缓存。像GPT一样并行训练,像RNN一样顺序推理。Linux基金会AI项目。在Windows、Office、NeMo中投入生产。RWKV-7(2025年3月)。模型参数高达140亿。
将包含解说和字幕的PPT/幻灯片转换为视频。从PPTX文件或slides.json中提取/渲染幻灯片图像,通过TTS生成解说,并添加字幕以创建最终的MP4视频。适用于“将PPT转为视频”,“生成演讲视频”,“制作含字幕视频”等请求。
科研炼金术士,生物医学专家与科研叙事。分析科研图表、结合 PubMed 等文献生成深度叙事。需配合 MCP 工具;用于论文图表解读、讨论升华与文献增强。
使用Whisper模型将音频片段转录为文本。为了提高准确性,请使用较大的模型(small、base、medium、large-v3),或者使用faster-whisper以优化性能。始终将转录的时间戳与说话人分割段对齐,以确保带有准确说话人标签的字幕。
专门从事学术研究、科学写作、ACD、定性方法论和防抄袭数据分析的助手
将Seedance 2.0与ComfyUI节点以及包括放大、帧插值、调色、合成和元数据清理在内的后期处理链集成。在构建自动化视频流水线、将Seedance连接到外部工具或完成并交付生成的视频片段时使用。
YouTube 视频智能剪辑工具。下载视频和字幕,AI 分析生成精细章节(几分钟级别),用户选择片段后自动剪辑、翻译字幕为中英双语、烧录字幕到视频,并生成总结文案。使用场景:当用户需要剪辑 YouTube 视频、生成短视频片段、制作双语字幕版本时。关键词:视频剪辑、YouTube、字幕翻译、双语字幕、视频下载、clip video
研究最新的ComfyUI模型、技术和社区发现。监控YouTube频道、GitHub仓库和HuggingFace。用带有时间戳的发现更新参考文件,并标记过时信息。可以通过/research comfyui命令调用,或在会话开始时自动进行过时性检查。
根据文本提示使用豆包SeeDream API生成图片。当用户请求AI生成的图片、艺术作品、插图或视觉内容创作时,请使用此技能。该技能处理API调用,将生成的图片下载到项目的/pic文件夹中,并支持最多连续生成4张图片。
查找超过550个中文电影、摄影和制作术语及其英文对应词,以及适用于Seedance 2.0的提示短语,涵盖22个类别,包括动作、武器和战斗相关的过滤安全词汇。在用普通话撰写提示、将制作概念翻译成中文Seedance词汇或验证术语准确性时使用。
当用户明确要求"优化 prompt"、"改进提示词"、"润色指令"或"将简陋 prompt 转换为最佳实践版本"时使用。基于 OpenAI 和 Anthropic 官方最佳实践,对用户提供的简陋 prompt 进行结构化优化,输出符合社区标准的高质量版本。