Skip to content
This repository was archived by the owner on Aug 11, 2026. It is now read-only.

Repository files navigation

statewalker-content

Content extraction: turn PDF, DOCX, XLSX, Markdown, and HTML into markdown text.

Packages

PackageDescription
@statewalker/content-extractorsPDF/DOCX/XLSX/Markdown/HTML extractors producing markdown text via a mime-aware registry.

Apps

AppDescription
indexer-testsIntegration tests for the indexer stack.

Development

pnpm install
pnpm run build
pnpm run test

Release

Releases are managed via changesets:

pnpm changeset # describe the change
pnpm version-packages # roll versions + regenerate CHANGELOGs
pnpm release-packages # publish to npm

About

Content pipeline: content-blocks, content-cli, content-extractors, content-llm, content-manager, content-scanner.

Topics

Resources

Stars

0 stars

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages