找回密码
 立即注册

用户中心登录

通过NE账号安全登录

搜索
热搜: NE3 NE 3 已解决
查看: 182|回复: 0

WorkBuddy+TextInxParse 与NeClaw对比测试

[复制链接]

12

主题

12

回帖

269

积分

中级会员

积分
269
发表于 2026-8-28 17:40:26 | 显示全部楼层 |阅读模式
https://tcnfdr2n75wp.feishu.cn/wiki/SCJSw44tkiMbtEkesjpcLKOVnxe?from=from_copylink
如果使用 NeClaw,怎么避免丢结构?
经过本次评测,NEclaw 底层解析能力并不弱——在强制 JSON 输出下,它与 WorkBuddy+TextInxParse 的结果几乎一致。问题在于默认模式下 LLM 会把结构拍平。如果想要 NeClaw 也给你完整的表格和公式,记住一个口诀:要什么结构,就明确说什么格式。
以下是经过验证的 5 条有效指令模板:
  • 解析这个 PDF,完整还原所有表格,保留合并单元格(rowspan/colspan),不要省略任何行或列。
  • 提取所有公式,用独立 LaTeX 块呈现,每个公式标注编号和所在页码。
  • 输出文档的标题层级树,格式:级别 / 标题文本 / 页码。不要合并或跳过任何章节。
  • 请输出 JSON,包含以下字段:titleTree: [{level, text, page}]、tables: [{id, name, page, html(保留 rowspan/colspan), crossPage: true/false}]、formulas: [{id, latex, page}]。不要添加任何解释性文字,只输出 JSON。
  • 两步走:第一步只做解析输出结构化 JSON;第二步基于 JSON 结果总结核心内容。
NeClaw 要你"会问"才能发挥出来。

回复

使用道具 举报

*滑块验证:
您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

手机版|小黑屋|NoteExpress

GMT+8, 2026-9-14 18:57 , Processed in 0.043748 second(s), 23 queries .

Powered by Discuz! X5.0

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表