Skip to content
dsh.fish

Browse

4 results

Skill

dsh-multimodal-skill

通过三方多模态 API 为纯文本 LLM 提供图像理解与文档理解能力(OCR、表格、公式、 版面解析、PDF/扫描件→Markdown、截图/照片/图表问答)。使用场景:用户粘贴或给出 图片/PDF 路径时解读内容、从文档提取文字与表格、对截图提问、发票/论文/票据解析。 触发词:图片理解、OCR、文档解析、截图内容、PDF 提取、表格识别、公式识别、票据识别、 扫描件、image、vision。实现为 Python 标准库 CLI(urllib/json/base64),零三方依赖。

v587d1
Skill

ecg-research

生物医学工程——心电信号(ECG)处理的科研操作规范。当任务涉及 ECG 数据读取/预处理、信号质量评估、R 峰与 QRS 检测、P-QRS-T 波形定位、心拍分割、心律失常/房颤(AF)/PVC/PAC 识别、HRV、时域/频域/时频分析、特征工程、机器学习/深度学习(1D CNN、LSTM、Transformer、自监督)、统计检验、科研绘图或 SCI 论文写作/审稿时使用。强制约束患者级数据划分、防泄漏、可复现性、结果真实性与临床边界。

kvuvuv1
Skill

ecommerce-material-studio

电商素材工坊(中英双语)。用户需要生成电商主图、详情图、场景图、产品图合成、品牌叠加时使用。自动识别品类→匹配风格→场景感知合成→统一文字→自动质检→多平台适配→标准化交付。E-commerce product image studio: category detection, style matching, scene-aware compositing, text overlay, quality check, multi-platform adaptation, batch delivery.

jiawood2006
Skill

doc-ocr

文档文字识别。用户提供 PDF/扫描件/图片(合同、发票、书页、截图),需要提取文字、转成可编辑文本时使用。扫描件自动 OCR(macOS Vision,中英文)。Document OCR: extract editable text from PDFs, scans, and images (contracts, invoices, book pages, screenshots) via macOS Vision.

jiawood2006