本文へ移動
cccskills

「text-extraction」の検索結果

9 件 ・ 関連度順

概要と使いどころ

Extract text from PDFs using shell tools when read_file fails

日本語の概要は準備中です。原文の説明を表示しています。

HKUDS/OpenSpace7,7552026年8月13日 更新

Ensures agents extract data from context files with validation and fallback strategies before resorting to assumptions or external searches.

日本語の概要は準備中です。原文の説明を表示しています。

HKUDS/OpenSpace7,7552026年8月13日 更新

Extract text from PDF files using pdftotext when read_file returns binary data

日本語の概要は準備中です。原文の説明を表示しています。

HKUDS/OpenSpace7,7552026年8月13日 更新

Extract text from PDFs using pdftotext when read_file returns binary data

日本語の概要は準備中です。原文の説明を表示しています。

HKUDS/OpenSpace7,7552026年8月13日 更新

Fallback workflow for extracting text from PDFs when read_file returns binary data

日本語の概要は準備中です。原文の説明を表示しています。

HKUDS/OpenSpace7,7552026年8月13日 更新

smart-ocr

無料

Extract text from images and scanned documents using PaddleOCR - supports 100+ languages

日本語の概要は準備中です。原文の説明を表示しています。

huangruiteng/CS-Notes4,0022026年10月9日 更新

给定 PMID / PMCID 取结构化全文(BioC XML/JSON)。封装 NLM BioC PubMed API(标题+摘要)和 BioC PMC OA API(开放获取全文),输出按章节切分的段落、表格上下文、RAG 友好 chunk。适合大批量入向量库。触发词:全文抽取 / BioC / RAG 入库 / 文献全文 / PMC 开放获取 / structured fulltext / 段落抽取 / 表格抽取 / fulltext to vector store。

日本語の概要は準備中です。原文の説明を表示しています。

EthanYoQ/Skill-hub112026年10月5日 更新

给定 PMID/PMCID 取结构化全文(NLM BioC XML/JSON)。封装 BioC PubMed(标题+摘要)和 BioC PMC OA(开放获取全文)端点,输出按章节切分的段落、表格上下文、RAG 友好 chunk,适合大批量入向量库。Fetches structured fulltext from NLM BioC API for PMID/PMCID, outputs section-segmented paragraphs and RAG-ready chunks. 触发词:全文抽取 / BioC / RAG 入库 / 文献全文 / PMC 开放获取 / structured fulltext / 段落抽取 / 表格抽取 / chunking / fulltext to vector store / paragraph extraction.

日本語の概要は準備中です。原文の説明を表示しています。

EthanYoQ/Skill-hub112026年10月5日 更新

Extract text from PDFs/scans (pymupdf, marker-pdf).

日本語の概要は準備中です。原文の説明を表示しています。

Lord1Egypt/awesome-skill-forge22026年6月10日 更新