glmocr
使用GLM-OCR API从图像中提取文本。支持高精度OCR、表格识别、公式提取和手写识别的图片和PDF。每当用户想要从图像中提取文本、对图片进行OCR处理、扫描文档、将图像转换为文本或处理任何图像文件以获取其文本内容时,都可以使用此技能。
把 Skill 的源码、资源快照、README、包体和安装信号放进一个可搜索、可筛选的公开目录。
使用GLM-OCR API从图像中提取文本。支持高精度OCR、表格识别、公式提取和手写识别的图片和PDF。每当用户想要从图像中提取文本、对图片进行OCR处理、扫描文档、将图像转换为文本或处理任何图像文件以获取其文本内容时,都可以使用此技能。
将用户提供的知识体系转化为可视化知识地图,包括层级结构图、知识点关系图和关联分析。当用户需要整理学科体系、技术栈结构、概念关系或学习路径时使用。例如"帮我整理前端开发的知识体系地图"、"生成Python学习路线图"、"分析数据结构各章节关系"。
官方技能,使用ZhiPu GLM-OCR API从图片中识别手写文本。支持多种手写风格、语言以及手写/印刷混合内容。当用户想要阅读手写笔记、将手写转换为文本或对手写文档进行OCR时,请使用此技能。
使用OCR从图像和扫描的PDF中提取文本。支持100多种语言,表格检测,结构化输出(markdown/JSON),以及批量处理。
把最终书稿或课程讲稿制作成按章节排列的音频,选择适合长篇聆听的旁白,通过代表性样章校准读音和节奏,再把同一声音延续到整本内容。
从文字、图片、首尾帧、参考素材或已有片段出发,生成、编辑和延长广告、产品与社交短视频。
只给一个选题,就拿到口播种草竖屏短片、可自行剪进版本的分镜静图和配音,全程零素材。
把一章小说或故事脚本改编成一组按顺序排好的带旁白竖屏推文视频片段,自动拆分镜、配插画、录旁白,同一个角色在每个镜头里长得一样。
在同一个流程里完成AI视频、AI图片、AI音乐与AI配音创作,编辑视觉成果,并集中管理做好的成品。
小红书短视频运营增长助手适合内容创作者、运营、品牌方、电商在用户提供了小红书笔记链接时使用,帮助基于输入材料生成情绪和舆情视图、用户画像和意图分析、优化与转化建议。
从文字、图片、首尾帧、参考素材或已有片段出发,生成、编辑和延长广告、产品与社交短视频。
无需安装ffmpeg的视频编辑工具。所有视频处理都在云端执行 - 无需本地安装ffmpeg。如果输入和输出都是URL或阿里云OSS,那么这项技能是首选。可以根据编辑需求和素材信息生成时间线配置,提交阿里云编辑任务,等待任务完成,并输出最终视频URL。当用户想要编辑视频、提及视频编辑、剪辑、视频制作、视频拼接、视频合成,或者需要将媒体文件处理成视频时使用。
为用户提供按知识点/难度智能组卷、生成答案解析与成绩分析的完整方案,覆盖小学、中学、大学公共课程(高数、英语、政治等)。使用场景:(1)用户需要某学科/某章节的模拟试题,(2)要求按知识点分布或难度梯度出题,(3)需要配套答案解析,(4)需要成绩分析与薄弱环节诊断。
学术论文智能优化系统,专为计算机深度学习方向硕士学位论文设计。 提供三维协同优化:降AI检测率、降查重率、学术润色提升。 采用两层文档架构(总揽+章节)与显式状态追踪,实现模块化闭环优化。 内置 30+ 种中文学术 AI 模式检测,支持困惑度与突发性重构。严格遵循“最小干预与句内微调”原则,严禁大段AI式重写,保留最真实的科研人类逻辑。
AI 简历助手 — 润色、定制、导出、评分中文/英文简历。支持 40+ 检查项、100 分五维评分、 多格式导出(Word/Markdown/HTML/LaTeX/PDF)。当用户需要创建、润色、评估、定制或导出简历时触发。
完全控制Windows桌面。鼠标、键盘、截图——像真人一样与任何Windows应用程序互动。
把创意、图片、首尾画面和多模态参考转化为高质感 2K AI 视频,覆盖广告、电商、品牌、动态海报、游戏 UI、电影片头和社交内容。
官方技能,使用智谱GLM-OCR API从图片和PDF中识别并提取表格,并将其转换为Markdown格式。支持复杂表格、合并单元格以及多页文档。当用户想要提取表格、识别电子表格或将表格图像转换为可编辑格式时,请使用此技能。
每日AI和技术新闻聚合器,从权威技术网站获取、总结并推送新闻。来源包括机器之心、36氪、TechCrunch、The Verge和MIT Technology Review。当用户请求每日技术/AI新闻、需要定时新闻递送、或者需要从多个来源进行新闻聚合和总结时使用,也可以用于设置自动新闻推送通知到Telegram/WhatsApp。
抖音上升热点选题助手适合内容创作者、运营、电商、营销在用户想知道接下来拍什么、写什么更可能有流量时使用,帮助基于输入材料生成上升热点列表、排名和变化趋势视图、可用于内容规划的选题线索。
粘一个视频链接,或者把文件截图交给它:把一条跑出来的短视频拆成钩子、中段和转化引导,再把这套结构套到你自己的选题上,出分镜表、分镜图、口播,以及一条由开场画面动起来的竖屏短片。
分析图片/视频并为文本到图像和文本到视频的AI工具(如Midjourney, Stable Diffusion, DALL-E, Sora, Runway, Kling, Pika)生成专业的提示。当用户希望从参考图片/视频生成提示、创建AI艺术提示或从视觉内容中获取提示工程建议时使用。
上传一条短视频,选择目标画风,把实拍视频转绘成动漫、国漫、水墨、黏土、赛博朋克等风格,同时保留人物、动作和镜头。
上传一张漫画分镜、人物设定或故事画面,把它变成一个动态的漫剧镜头——单张漫画动起来、首尾分镜过渡,或多张参考组合成全新的漫剧镜头。