PaddleOCR 项目
PaddleOCR 是一款功能强大且轻量的 OCR 工具包,可将任意 PDF 或图像文档转换为结构化数据,衔接图像/PDF 与大语言模型(LLM),支持超过 100 种语言。
Data Analysis & Investment Research
帮助用户读取表格、财报、市场资料和研究数据,形成可检查的分析过程。
PaddleOCR 是一款功能强大且轻量的 OCR 工具包,可将任意 PDF 或图像文档转换为结构化数据,衔接图像/PDF 与大语言模型(LLM),支持超过 100 种语言。
面向分析师、量化研究员和 AI Agent 的金融数据平台
MCP 工具接入项目,用于把外部工具、服务或数据源安全接入 AI 宿主。
数据与 AI 管道项目,用于验证输入输出、状态、延迟、失败恢复和部署边界。
Agent SDK 项目,用于验证工具调用、状态管理、handoff、trace、评估和权限边界。
<a href="https://answer.apache.org">Answer 是一个面向 Apache 生态的开源问答平台,用于构建和管理基于社区的知识问答系统。</a>
FinRL®:金融强化学习。🔥
Tiny RDM(Tiny Redis Desktop Manager)是一款现代、轻量、界面精美的 Redis 桌面客户端,支持 Mac、Windows 和 Linux,并提供可通过 Docker 部署的 Web 版本。
Kedro 是一个面向生产的数据科学工具箱,遵循软件工程最佳实践,帮助你构建可复现、易维护、模块化的数据工程与数据科学流水线。
Deeplake 是面向 Agent 的 AI 数据运行时,提供无服务器的 Postgres 与多模态数据湖,可支持大规模检索与训练。
一个用于在文本、图像和结构化数据中检测、编辑、遮盖和匿名化敏感数据(PII)的开源框架,支持 NLP、模式匹配和可自定义的流水线。
灵活、健壮的 AI 编排平台,助力你在构建 AI 工作流时无缝协同数据、模型与算力。
为 ML/AI 应用提供 GPU 加速的 Postgres。
可扩展且高效的数据转换框架,兼容 dbt。
AI 原生搜索数据库,集成向量、文本、结构化与半结构化数据于一身,专为智能体存储设计,让智能体更智能、更易运行、更稳定。
Apache Hamilton 帮助数据科学家和工程师定义可测试、模块化、自描述的数据流,并内建血缘追踪与元数据,支持在所有 Python 运行环境中执行和扩展。
AI 原生框架,用于构建数据门户。只需一份简要说明,即可借助 agentic 技能在数分钟内搭建完整门户并接入数据集,支持任意后端(CKAN、GitHub、Frictionless)。
一个零代码的多智能体框架,用于结合你的数据构建 LLM 智能体、工作流和应用
用于非结构化数据的高性能检索引擎
MCP 工具接入项目,用于把外部工具、服务或数据源安全接入 AI 宿主。
NornicDB:面向 RAG 与 LLM 场景设计的图数据库。
面向 Claude Code 的投研技能:自上而下的宏观框架、中英双语自然语言触发、Telegram 提醒(2 分钟定时 + 1–3 秒 Webhook),适用于个人金融买方场景中的波段/仓位/LEAPS 操作,非高频交易;路线图见 NEXT-STEPS.md。
面向数据科学家和分析师的 Claude、Codex 与 GitHub Copilot 技能,用于在 PostGIS、BigQuery、Snowflake 和 Wherobots 上处理地理空间数据。
Mantine DataTable 是一个基于 Mantine UI 组件库构建的表格组件,用于在 React 应用中展示和操作数据。
TradeMemory Protocol 为 AI 交易 Agent 提供持久化、按结果加权的记忆,提升跨会话决策能力。