') + ')', 'gi'); if (regex.test(text)) { found = true; var frag = document.createDocumentFragment(); var parts = text.split(regex); parts.forEach(function(part, i) { if (i % 2 === 0) { frag.appendChild(document.createTextNode(part)); } else { var span = document.createElement('span'); span.className = 'userscript-highlight'; span.textContent = part; frag.appendChild(span); } }); node.parentNode.replaceChild(frag, node); } }); } else if (node.nodeType === 1 && node.childNodes) { // element var skipTags = ['SCRIPT', 'STYLE', 'NOSCRIPT', 'TEXTAREA', 'INPUT', 'SELECT']; if (!skipTags.includes(node.tagName)) { Array.from(node.childNodes).forEach(highlight); } } } highlight(document.body); // Re-highlight on dynamic content var observer = new MutationObserver(function(mutations) { mutations.forEach(function(m) { m.addedNodes.forEach(function(node) { if (node.nodeType === 1 || node.nodeType === 3) highlight(node); }); }); }); observer.observe(document.body, { childList: true, subtree: true }); })(); } } catch(__e) { console.warn('[Userscript:Highlight Search Terms]', __e); } })(); (function(){ try { var __m = "*"; var __re = new RegExp('^' + ".*" + ', 'i'); if (__m === '*' || __re.test(location.href)) { // Strip utm_, fbclid, gclid, etc. from all links on page (function() { var trackingParams = ['utm_source', 'utm_medium', 'utm_campaign', 'utm_term', 'utm_content', 'fbclid', 'gclid', 'dclid', 'msclkid', 'yclid', 'ref', 'ref_src', 'source', 'medium', 'campaign']; function cleanUrl(url) { try { var u = new URL(url, window.location.origin); var changed = false; trackingParams.forEach(function(p) { if (u.searchParams.has(p)) { u.searchParams.delete(p); changed = true; } }); return changed ? u.toString() : url; } catch (e) { return url; } } function cleanLinks() { document.querySelectorAll('a[href]').forEach(function(a) { var clean = cleanUrl(a.href); if (clean !== a.href) a.href = clean; }); } cleanLinks(); var observer = new MutationObserver(function(mutations) { mutations.forEach(function(m) { m.addedNodes.forEach(function(node) { if (node.nodeType === 1) { if (node.tagName === 'A') cleanLinks(); node.querySelectorAll('a[href]').forEach(function(a) { var clean = cleanUrl(a.href); if (clean !== a.href) a.href = clean; }); } }); }); }); observer.observe(document.body, { childList: true, subtree: true }); })(); } } catch(__e) { console.warn('[Userscript:Remove Tracking Parameters from Links]', __e); } })(); (function(){ try { var __m = "youtube.com"; var __re = new RegExp('^' + "youtube\\.com" + ', 'i'); if (__m === '*' || __re.test(location.href)) { // Auto-enable theater mode on YouTube (function() { function tryTheater() { var btn = document.querySelector('button[aria-label="Theater mode"], ytd-player #player button[title="Theater mode"]'); if (btn && !btn.classList.contains('activated')) { btn.click(); } } // Try immediately tryTheater(); // Try after navigation (SPA) var lastUrl = location.href; setInterval(function() { if (location.href !== lastUrl) { lastUrl = location.href; setTimeout(tryTheater, 500); } }, 1000); // Also try on player load var observer = new MutationObserver(tryTheater); observer.observe(document.body, { childList: true, subtree: true }); })(); } } catch(__e) { console.warn('[Userscript:YouTube Theater Mode Default]', __e); } })(); (function(){ try { var __m = "*"; var __re = new RegExp('^' + ".*" + ', 'i'); if (__m === '*' || __re.test(location.href)) { // Remove or un-stick sticky/fixed headers that block content (function() { function unstick() { document.querySelectorAll('header, nav, [role="banner"], .header, .navbar, .sticky, .fixed-top, [style*="position: fixed"], [style*="position:sticky"]').forEach(function(el) { if (el.style.position === 'fixed' || el.style.position === 'sticky' || getComputedStyle(el).position === 'fixed' || getComputedStyle(el).position === 'sticky') { el.style.position = 'static'; el.style.top = 'auto'; el.style.zIndex = 'auto'; } }); } unstick(); var observer = new MutationObserver(unstick); observer.observe(document.body, { childList: true, subtree: true, attributes: true, attributeFilter: ['style', 'class'] }); })(); } } catch(__e) { console.warn('[Userscript:Kill Sticky Headers]', __e); } })(); })(); 【外滩大会2026】ScholarForge OS|研语工坊:科研事实安全审校工作台 · Issue #52 · modelstudioai/modelstudioai.github.io · GitHub
Skip to content

【外滩大会2026】ScholarForge OS|研语工坊:科研事实安全审校工作台 #52

Description

@liqinglq666

参赛项目名称

ScholarForge OS|研语工坊
科研事实安全审校工作台

普通 AI 帮助修改论文,ScholarForge 负责阻止 AI 改错论文。
模型提出候选 · 代码独立核验 · 作者最终决定

团队 / 作者

个人开发者:liqinglq666
GitHub:@liqinglq666

我做了什么

我使用阿里云百炼 qwen-plus 构建了一套面向研究生、科研人员和学术编辑的科研写作审校系统,用来解决一个常被忽略的问题:

大模型在翻译、润色和重写论文时,可能悄悄改变数值、单位、引用、实验声明、因果关系、结论强度或研究范围。

ScholarForge 没有把模型输出直接覆盖到论文,而是在 AI 候选稿与作者工作稿之间加入独立的 ScholarForge Safety Gate|科研事实安全门

  1. 模型只提出候选:生成候选稿、问题位置、证据和修改理由,无权覆盖作者文本;
  2. 代码独立核验:检查数值、单位、引用、术语、实验声明、因果、确定性与研究范围;
  3. 作者逐条决定:接受、拒绝或暂缓建议,只有满足唯一文本锚点、不跨段落、无重叠且不改变科研事实等条件时,才允许安全应用;
  4. 高风险结果自动隔离:硬规则失败时进入 quarantined 状态,保留原文、展示阻断证据并关闭自动应用;
  5. 全流程可恢复:支持撤销、重做、历史记录、版本比较、JSON 备份以及 TXT、Markdown、清洁 DOCX 导出。

系统目前支持三类核心任务:

  • 科研中译英:保护数值、单位、术语、引用和证据强度;
  • 英文保守润色:改善语法、句法、连贯性和学术表达,但不新增事实或升级结论;
  • 投稿前检查:识别语言、报告规范、逻辑和证据边界风险,不预测录用,也不替代同行评议。

此外还实现了:

  • 粘贴文本与浏览器端 DOCX 正文提取;
  • 公开合成示例、我的文本、DOCX 导入三种明确来源模式;
  • 多论文项目、多章节、目标期刊与术语规则;
  • 跨章节数值、样本量和术语一致性检查;
  • 导师意见拆分、回复记录与版本比较;
  • 请求大小、会话/IP 限流、并发、超时和每日预算熔断;
  • 模型未配置时明确返回 503,不会生成伪造的演示结果。

使用的工具

  • OpenWork / 百炼 CLI:项目运行时未依赖 OpenWork 或 CLI,服务端直接调用百炼 DashScope OpenAI 兼容接口
  • 百炼能力 / 模型:阿里云百炼 DashScope,默认模型 qwen-plus,支持通过环境变量切换兼容模型
  • Skill 名称:自研 ScholarForge Safety Gate 结构化审校工作流与确定性规则引擎(项目内能力,非官方独立 Skill 包)
  • 其他:Next.js 16、React 19、TypeScript strict、Mammoth、docx、Vitest、Playwright、Vercel,可选 Supabase 偏好同步

效果展示

1. 科研事实安全审校工作流

ScholarForge OS 科研事实安全审校工作流

2. 任务配置工作台全览

正式线上版本的快速审校工作台。左侧为论文正文、来源状态和同主题公开示例,右侧集中设置任务类型、章节、目标期刊、术语规则和分析状态。

ScholarForge OS 任务配置工作台全览

3. 三种任务联动与正文来源保护

切换到“科研中译英”后,公开示例的正文、任务名称、期刊和术语规则同步更新;用户一旦编辑正文或设置,系统会进入“我的文本”模式,之后切换任务不会覆盖作者内容。

ScholarForge OS 科研中译英任务联动

4. 分析前确认

在调用模型前,系统明确展示字符数、任务类型、正文来源和章节,并再次提醒作者核对事实、数值、单位、方法、引用和结论强度。只有用户主动确认后才会发送分析请求。

ScholarForge OS 分析前确认弹窗

5. Safety Gate 与问题中心

审校结果页同时展示代码独立执行的数值与单位、术语与引用、因果/结论强度/研究范围检查,以及逐条问题证据。作者可以接受、拒绝或暂缓建议;不满足安全应用条件的修改只能保留为人工建议。

ScholarForge OS Safety Gate 与问题中心

6. 作者确认后的交付文件

完成逐条核对后,可导出作者工作稿 TXT、审校报告 Markdown,以及重新生成的清洁 DOCX;原始 DOCX 不会被原地覆盖。

ScholarForge OS 导出交付文件

上述工作台图片均由 Playwright Chromium 从当前正式线上版本截取。为避免泄露真实论文内容,截图使用公开合成的水泥基材料科研案例;Safety Gate 结果页使用确定性的结构化审校响应,仅用于稳定展示真实产品界面与交互,不包含任何用户论文或隐私数据。

推荐评审路径

  1. 打开在线快速体验;
  2. 载入一个公开合成科研案例;
  3. 切换“科研中译英 / 英文保守润色 / 投稿前检查”,观察正文与任务设置联动;
  4. 确认本次发送的正文来源、字符数、任务和章节;
  5. 运行真实百炼模型分析;
  6. 查看 Safety Gate 的逐项检查与阻断证据;
  7. 对每条建议选择接受、拒绝或暂缓;
  8. 只应用代码允许的局部修改,并体验撤销、重做和导出。

当前工程质量门包括:生产依赖审计、ESLint、75 项单元/API/组件测试、TypeScript、Next.js 生产构建,以及 30 项桌面端与移动端 Playwright E2E。

项目链接

踩坑记录(可选)

1. 不能相信模型自己声明“修改安全”

早期只依赖模型输出风险等级,但模型可能遗漏数字变化,也可能声称候选稿安全。最终把权限拆开:模型负责提出候选,代码重新计算硬规则,作者负责最终决定。

2. 结构化模型输出会漂移或截断

模型可能返回非 JSON、字段缺失、重复问题、截断内容或空结果。现在服务端会验证响应结构、结束原因、必填字段和重复项;异常时返回明确错误,不把不完整结果包装成成功。

3. “接受建议”不等于可以直接替换

同一句话可能在论文中出现多次,正文也可能已被作者修改。安全应用必须重新验证唯一锚点、段落边界、事实一致性、修改重叠和当前工作稿状态,否则只保留为人工建议。

4. 隐私与演示体验需要同时成立

DOCX 原始二进制文件不上传,正文只在用户确认分析后发送;公开示例只填入浏览器草稿,不会自动调用模型。未配置 API Key 时明确禁用分析,不用假数据伪装产品可用。

Safety Gate 通过只代表候选稿通过当前自动规则,不代表科学、统计、引用或伦理内容已经被验证。最终论文责任始终属于作者。

Metadata

Metadata

Assignees

No one assigned

    Labels

    Type

    No type

    Projects

    No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions