Andy 是一个面向数学科研的自主求解、问题生成和严格验证系统。它支持论文或开放问题输入、独立正确性核验、文献辅助的新问题生成、引理 DAG 证明、长期记忆和可追溯报告。
Andy 目前属于研究型软件。模型给出的数学结论即使通过自动核验,也应由研究者独立复核后再用于论文或正式成果。
- 有答案时直接核验:对用户答案或从 PDF 定位出的完整证明进行前提、计算和逻辑三维核验,避免重复求解。
- 无答案时自主求解:构造答案并由独立核验模型审查;核验失败后定向修订。
- 生成一个可研究的新问题:用户可指定问题方向和简单、标准、研究级难度;评估阶段逐项给出分数、理由和修改指令。
- 论文辅助研究:除一份主材料外,可上传最多八篇参考论文;Andy 会分析论文之间的共同点、差异、互补关系和研究缺口。
- 按需检索:仅在证据不足时调用 Tavily,不把搜索变成每个阶段的固定动作。
- DAG 严格证明:先规划引理依赖图,再逐节点证明、局部核验和冻结;只修复失败节点及其后代。
- 深度研究模式:先低成本探索多条路线,选择最有希望的一条,再转为 DAG 严格完成。
- 长期记忆与续跑:保存研究者明确要求的证明方法偏好、评分偏好、已验证结论和失败路线;失败任务可从检查点继续。
- 本地研究前端:展示阶段进度、模型接口返回的推理内容、核验过程、评分理由、证明图、历史任务及报告下载。
当前默认配置使用 DeepSeek 作为主求解与生成模型,使用独立 Claude 接口完成数学正确性核验。模型与接口均可在本地运行时配置中替换。
Andy/
├─ src/andy/ Python 后端、研究流水线、内置 Agent/Skill/Tool/MCP 模板
├─ frontend/ React/Vite 本地科研工作台
├─ scripts/ 安装、启动和健康检查脚本
├─ docs/ 使用说明、文件指南和 DAG 执行说明
├─ config/ 不含密钥的凭据示例
└─ experiments/ 经过审查和脱敏的实验成果
安装后生成的 runtime/ 保存本机配置、凭据、项目、会话、记忆、知识库和报告。该目录不会提交到 Git。
- Windows PowerShell
- Python 3.10 或更高版本
- Node.js 与 npm(构建前端及高质量 KaTeX PDF)
- 本机 Chrome 或 Edge(打印 KaTeX 报告 PDF;不可用时安全降级为 ReportLab)
git clone https://github.com/mowaiwaim/Andy.git
Set-Location .\Andy
.\scripts\setup-andy.ps1在本机填写 API Key。真实密钥只应保存在安装生成的 runtime/config/credentials.json 中,可参考 config/credentials.example.json:
{
"DEEPSEEK_API_KEY": "",
"OFOX_EVALUATION_API_KEY": "",
"TAVILY_API_KEY": ""
}启动 Web 工作台:
.\scripts\start-andy-web.ps1健康检查:
.\scripts\check-andy.ps1直接提交问题:
.\.venv\Scripts\python.exe -m andy --home .\runtime solve `
--problem "在这里填写数学问题" `
--answer "可选:待核验答案或证明" `
--prompt "可选:原题求解和核验要求" `
--question-direction "可选:新问题生成方向" `
--target-question-difficulty research `
--project my-research-project提交主论文及参考论文:
.\.venv\Scripts\python.exe -m andy --home .\runtime solve `
--file "C:\path\to\main-paper.pdf" `
--reference-file "C:\path\to\reference-1.pdf" `
--reference-file "C:\path\to\reference-2.pdf" `
--project my-research-project“原题研究要求”只用于原题求解与核验;“生成问题的方向”只在新问题生成、评分和返修阶段生效。
- 原题及其核验后的完整解答;
- Andy 生成的新问题、评分理由和完整证明;
- 参考论文逐篇分析与跨文献综合;
- Markdown、JSON、完整可追溯审计 PDF、数学阅读版 PDF 和精简 PDF;
- 可恢复检查点和脱敏后的可追溯记录。
示例成果见 experiments/hong-zhang/。
示例实验的完整审计层公开了 Prompt、调用API 明确返回的推理文本、未定稿输出、失败草稿、评分返修、DAG 节点和核验过程,以便读者复核 Andy 的运行成果。
- 上传的论文、提示词、模型响应和日志会保存在本机运行时目录中。
- 发布实验前应对版权、个人信息、本机路径和模型载荷进行人工审查。
详见 SECURITY.md。