news 2026/9/16 20:48:23

Hyper-Extract 模型兼容性全表:哪些 LLM 支持 json_schema 结构化抽取?一次看懂

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
Hyper-Extract 模型兼容性全表:哪些 LLM 支持 json_schema 结构化抽取?一次看懂

Hyper-Extract 模型兼容性全表:哪些 LLM 支持 json_schema 结构化抽取?一次看懂

【免费下载链接】Hyper-ExtractHypergraph is more powerful. Transform unstructured text into structured knowledge with LLMs. Graphs, hypergraphs, and spatio-temporal extractions — with one command.项目地址: https://gitcode.com/GitHub_Trending/hy/Hyper-Extract

Hyper-Extract 是一个用 LLM 把非结构化文本转换为结构化知识的开源工具,核心依赖function calling(json_schema 结构化输出)来驱动 AutoGraph、AutoList 等抽取类型。本文整理一份完整模型兼容性清单:哪些云模型、本地模型支持 json_schema 抽取,哪些会踩坑,以及如何一行命令切换 Provider。

为什么只有支持 function calling 的模型才能用?

Hyper-Extract 的内部抽取管线统一走 LangChain 的with_structured_output,并强制指定method="function_calling"(见 hyperextract/types/base.py):

  • 它会把你的 Pydantic Schema 转成JSON Schema,通过工具调用下发给模型
  • 模型必须"原生听懂"这个工具定义,才能保证输出 100% 符合结构
  • 如果模型只支持json_object(在 prompt 里提一句 "json" 让模型自由发挥),就会出现两种典型翻车:
    • 报错messages must contain the word 'json'
    • 返回的不是 JSON,或 JSON 结构缺字段

所以判断标准只有一个:模型是否支持 function calling / structured output。

📋 云端模型兼容性全表

平台已验证模型函数调用是否可用备注
OpenAIgpt-4o / gpt-4o-mini / gpt-5官方原生支持,首选推荐
Anthropicclaude-opus-4-8 / claude-sonnet-4-6 / claude-haiku-4-5✅(工具调用)仅提供 LLM,无嵌入接口,需搭配 OpenAI 兼容 Embedding;需安装hyperextract[anthropic]
Google Geminigemini-3.8-flash / gemini-2.5-flash / gemini-2.5-pro✅(工具调用)同上,无成熟嵌入路径;需安装hyperextract[google]
DeepSeekdeepseek-v4-flash / deepseek-v4-proOpenAI 兼容;V4 默认开启 thinking 模式,Hyper-Extract 会自动关闭以保证 json_schema 抽取可用
OrcaRouterorcarouter/auto、openai/gpt-4o-mini、anthropic/claude-haiku-4-5 等OpenAI 兼容网关,一把密钥路由 150+ 模型
阿里云百炼qwen-plus / qwen-turbo / qwen3.6-plus / deepseek-r1开箱即用
阿里云百炼qwen-max / deepseek-v3仅支持 json_object,不兼容 function calling

⚠️百炼用户注意:如果你用 qwen-max 或 deepseek-v3 遇到messages must contain the word 'json'错误、或模型不返回 JSON,说明该模型不支持 function calling,请切换到qwen-plus、qwen-turbo 或 deepseek-r1

🖥️ 本地部署:vLLM + Qwen3.5-9B

没有 API Key 也能玩。官方验证过的本地组合:

角色模型量化方式显存占用验证状态
LLMQwen3.5-9BGPTQ-Marlin 4bit~8GB✅ AutoList / AutoGraph
EmbeddingBAAI/bge-m3~2GB✅ 语义搜索

两个关键坑位

  1. 必须关闭 thinking 模式——Thinking 模型会输出</think>标签,与"从首个 token 起就是 JSON"的约束解码冲突。启动 vLLM 时加参数--default-chat-template-kwargs '{"enable_thinking": false}'
  2. 量化选 GPTQ-Marlin,AWQ 在 vLLM 0.21.0 中存在兼容性问题

云端 Embedding 方面,text-embedding-3-small(1536 维)和百炼text-embedding-v4(1024 维)均已验证可用。

🔌 一行代码切换 Provider

所有平台共用同一个create_client()接口,只改第一行就能换模型(源码见 hyperextract/utils/client.py):

from hyperextract import create_client # OpenAI(默认 gpt-4o-mini + text-embedding-3-small) llm, emb = create_client("openai", api_key="sk-xxx") # 百炼(默认 qwen3.6-plus + text-embedding-v4) llm, emb = create_client("bailian", api_key="sk-xxx") # DeepSeek(thinking 自动关闭) llm, emb = create_client( llm="deepseek", embedder="openai:text-embedding-3-small", ) # 本地 vLLM llm, emb = create_client( llm="vllm:Qwen3.5-9B@http://localhost:8000/v1", embedder="vllm:bge-m3@http://localhost:8001/v1", api_key="dummy", )

字符串简写格式支持provider:model@url三段式,例如"bailian:qwen-plus"覆盖 LLM 但保留预设 Embedding。完整配置选项参考 docs/zh/python/guides/provider-configuration.md,各平台可直接运行的示例脚本在 examples/providers/ 目录下(openai_demo.py、bailian_demo.py 等)。

CLI 用户则只需:he config init -p bailian -k sk-xxx

✅ 选型速查:30 秒决定用哪个模型

  • 图省事、效果稳→ OpenAI gpt-4o-mini,官方原生支持,零配置
  • 国内直连、中文任务→ 百炼 qwen-plus / qwen3.6-plus,避开 qwen-max
  • 低成本推理→ DeepSeek v4-flash(thinking 自动帮你关)
  • 一把钥匙开 150+ 模型→ OrcaRouter 网关
  • 完全离线→ 本地 vLLM 部署 Qwen3.5-9B(4bit 量化,8GB 显卡起步)

完整兼容性说明与 vLLM 部署命令详见 docs/zh/concepts/provider-system.md。

【免费下载链接】Hyper-ExtractHypergraph is more powerful. Transform unstructured text into structured knowledge with LLMs. Graphs, hypergraphs, and spatio-temporal extractions — with one command.项目地址: https://gitcode.com/GitHub_Trending/hy/Hyper-Extract

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/9/16 20:47:00

Win10下SolidWorks 2016工程图属性链接失效原因与修复指南

1. 项目概述&#xff1a;为什么在Win10环境下操作SW2016工程图与零件属性的链接&#xff0c;会成为工程师每天必踩的“隐形坑”SolidWorks 2016在Windows 10系统上运行&#xff0c;表面看是兼容的&#xff0c;但实际工作中——尤其是涉及工程图与零件模型属性自动关联的环节——…

作者头像 李华
网站建设 2026/9/16 20:46:17

OpenCV图像去畸变实战:从相机标定到参数调优全流程

做机器视觉项目的朋友&#xff0c;肯定都遇到过这种场景&#xff1a;相机标定做完&#xff0c;用广角镜头一拍&#xff0c;画面边缘的直线全变成了弧线&#xff0c;测量软件报出来的坐标偏得离谱。我在一个工业测量项目里就被这个坑过&#xff0c;后来花了一整周研究OpenCV图像…

作者头像 李华
网站建设 2026/9/16 20:46:08

SpringBoot智慧校园平台开发实战与架构设计

1. 项目概述与背景分析安龙四中智慧校园信息服务平台是一个基于SpringBoot框架开发的综合性校园数字化解决方案。这个项目源于当前教育信息化2.0行动计划的大背景&#xff0c;旨在通过技术手段解决传统校园管理中存在的效率低下、信息孤岛等问题。我在实际开发中发现&#xff0…

作者头像 李华
网站建设 2026/9/16 20:44:19

UFO Galaxy TaskStarLine 深度解析:用智能依赖边编织任务星座 DAG

UFO Galaxy TaskStarLine 深度解析&#xff1a;用智能依赖边编织任务星座 DAG 【免费下载链接】UFO UFO: Weaving the Digital Agent Galaxy 项目地址: https://gitcode.com/GitHub_Trending/uf/UFO 本篇技术指南围绕 UFO 项目 Galaxy 框架中的核心组件 TaskStarLine 展…

作者头像 李华
网站建设 2026/9/16 20:44:11

TVBOX 2026版:无广告4K影音系统技术解析

1. 项目背景与需求解析最近在折腾家庭影音系统时&#xff0c;发现一个挺有意思的现象&#xff1a;越来越多用户开始追求自主可控的影视资源解决方案。传统视频平台会员费水涨船高不说&#xff0c;最让人头疼的是无处不在的广告和突如其来的卡顿。这不&#xff0c;最近接触到一套…

作者头像 李华