CodeWeaver: コード構造とコンテンツから自動的にMarkdownドキュメントを生成します。一般的な紹介 CodeWeaverは、コード・ライブラリを単一の見やすいMarkdownドキュメントに編むために設計されたコマンドライン・ツールです。ディレクトリを再帰的にスキャンし、各ファイルの内容をコードブロックに埋め込むことで、プロジェクトのファイル階層を構造化した表現を生成します。このツールは...最新のAIツール# AI Java オープンソースプロジェクト# ドキュメントの抽出とクリーニング4ヶ月前05440
pure.md:URLの前に "pure.md/"を挿入して、きれいなテキストを取り出す。一般的な紹介 pure.mdはAIエージェントや開発者のためのツールで、ウェブコンテンツやファイルを素早くMarkdown形式に変換することに重点を置いています。プロキシサービスによるクローラー対策の制限を回避し、ウェブページのコアデータを抽出し、クリーンなMarkdownを出力します。最新のAIツール# AIオープンサービス# ドキュメントの抽出とクリーニング2ヶ月前05140
Cloudsquid: ドキュメントをアップロードし、構造化データのインテリジェントな抽出のための要件を記述する。综合介绍 Cloudsquid 是一家 2023 年成立于德国柏林的公司,专注于用人工智能简化文件处理。它的核心产品是一个在线数据提取平台,用户只需上传 PDF、图片、音频、视频等文件,简单说明需要提...最新のAIツール# ドキュメントの抽出とクリーニング2ヶ月前05130
フライング・パドル PP-TableMagic: 複雑なテーブルの構造化情報抽出表格识别的目标是解析图片中的表格,准确识别表格结构和单元格位置,并将其还原为结构化的表格格式(例如 HTML)。在当今信息化时代,大量重要的表格数据仍以非结构化状态存在(如扫描文档中的信息统计表图片...最新のAIツール# AI Java オープンソースプロジェクト# ドキュメントの抽出とクリーニング3ヶ月前05080
Supametas.AI:非構造化データをLLMの高可用性データに抽出する包括的な紹介 Supametas.AIは、ウェブページ、文書、音声、動画などの乱雑なデータを、AIが利用できる構造化データに整理することに特化したデータ処理プラットフォームです。ウェブリンク、API、ローカルファイルなど複数のソースからデータを収集し、JSONとして出力することができます。最新のAIツール# AIオープンサービス# ドキュメントの抽出とクリーニング2ヶ月前05060
PDFコンテンツを自動的に解析し、オープンソースサービスのテキストとテーブルを抽出します。综合介绍 它能自动分析PDF文档的布局,识别页面中的文字、标题、图片、表格、公式等元素,并判断它们的正确顺序。工具支持OCR功能,可以把扫描PDF转为可搜索文本。它基于Docker运行,提供两种模型...最新のAIツール# AI Java オープンソースプロジェクト# OCR# ドキュメントの抽出とクリーニング2ヶ月前04050
DevDocs:技術文書を素早くクロールして整理するMCPサービス概要 DevDocsは、CyberAGIチームによって開発され、GitHubでホストされている完全に無料のオープンソースツールです。プログラマーやソフトウェア開発者のために設計されたこのツールは、技術文書のURLから始まり、関連するページを自動的にクロールし、簡潔なMa...最新のAIツール# AI Java オープンソースプロジェクト# MCPサービス# ドキュメントの抽出とクリーニング2ヶ月前03660
Chatlog: WeChatのチャットログを抽出・照会するオープンソースツール一般的な紹介 チャットログはWeChatのローカルデータベースからチャットログを抽出し、照会することに特化したオープンソースツールです。WeChatバージョン3.xと4.0をサポートし、WindowsとmacOSの両システムをカバーしています。ユーザーは、コマンドライン、ターミナルインターフェース、またはH...最新のAIツール# AI Java オープンソースプロジェクト# MCPサービス# ドキュメントの抽出とクリーニング2ヶ月前03560
VOP: 複雑な図や数式を抽出するOCRツール综合介绍 Versatile OCR Program 是一个开源的光学字符识别(OCR)工具,专门为处理复杂的学术和教育文档设计。它能从PDF、图像等文件中提取文本、表格、数学公式、图表和示意图,并生...最新のAIツール# AI Java オープンソースプロジェクト# OCR# ドキュメントの抽出とクリーニング2ヶ月前03260
OneFileLLM: 複数のデータソースを単一のテキストファイルに統合综合介绍 OneFileLLM 是一个开源命令行工具,旨在将多种数据源整合成单一文本文件,方便输入大语言模型(LLM)。它支持处理 GitHub 仓库、ArXiv 论文、YouTube 视频转录、网页...最新のAIツール# AI Java オープンソースプロジェクト# ドキュメントの抽出とクリーニング2ヶ月前02800