news 2026/10/6 22:50:48

使用AI将PNG图中的公式转成MathML公式

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
使用AI将PNG图中的公式转成MathML公式

- 1 -

知识背景与应用场景

在技术文档撰写、学术资料整理、教育资源开发等场景中,经常需要将纸质公式、图片格式(如PNG)的公式嵌入到结构化文档,如DITA文档,中。MathML作为一种基于XML的数学标记语言,能够精准描述数学公式的结构和语义,是结构化文档中嵌入公式的标准格式之一。

以前的传统方法,需要人工用公式编辑器重新制作公式来生成MathML,这种方式效率低,遇到复杂公式不仅费时间,还容易出错;而且得专门学习怎么用公式编辑器,上手难度不小。

现在用Oxygen软件里的AI Positron插件,通过自然语言方式交流,就能自动把PNG格式的公式转换成MathML,大大降低了操作难度,提高了工作效率,适合需要批量处理公式的场景。

- 2 -

核心操作步骤

让AI识别PNG公式,生成MathML代码并嵌入DITA文档,具体步骤如下:

步骤1:图像预处理,确保公式识别准确性

选择清晰无破损的PNG图像,用图片编辑工具裁剪保留公式主体、删除无关内容,也可根据需要调整图像亮度或进行锐化处理,提升AI识别精度。

步骤2:启动AI插件并上传预处理图像

确保Oxygen软件已安装并激活AI Positron插件且完成授权,随后打开Oxygen并定位到DITA topic中需插入公式的位置,启动插件后上传预处理好的图像,确认加载正确。

步骤3:通过自然语言交互下达公式转换指令

在插件对话框中输入指令:“请识别图中的公式,并生成MathML公式或方程”,若图像含多个公式或对MathML版本有要求可补充说明,发送指令后等待转换完成,简单公式1-3秒即可完成,复杂公式约需5-10秒。

步骤4:验证与插入MathML代码

查看生成的MathML代码及公式预览效果,对比原始图像检查是否存在错误,若有错误可补充说明问题让AI修正,确认无误后点击“插入到文档”,完成公式嵌入。

- 3 -

操作示例

1. 上传带公式的图

2. 输入提示词

3. 点击应用将AI生成的MathML公式插入DITA topic中。

- 4 -

功能核心价值

核心价值具体体现在三个方面:

  1. 节省人力:不用再人工重新制作和编辑公式,批量处理时能节省80%以上的时间,减轻排版人员的工作压力。

  2. 提高效率和准确性:AI识别转换公式的速度快,再加上提前处理好图片,能减少识别错误,降低人工操作失误,提升文档质量。

  3. 降低操作难度:不用专门学习公式编辑器的使用方法,也不用了解MathML的相关规范,只要用日常语言交流就能操作,让更多人都能完成公式转换,提高团队合作效率。

版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/10/5 10:33:56

【Open-AutoGLM安装终极指南】:仅限内部流传的3大高效部署方案

第一章:Open-AutoGLM部署安装概述 Open-AutoGLM 是一个面向自动化生成语言模型任务的开源框架,支持快速部署、模型微调与推理服务集成。该框架基于 PyTorch 和 Hugging Face Transformers 构建,具备良好的可扩展性与模块化设计,适…

作者头像 李华
网站建设 2026/10/5 10:33:57

在Java中加载和调用Embedding模型

推荐方案 生产环境推荐:使用ONNX Runtime方案,性能好,无需Python依赖快速原型开发:使用REST API方案,部署简单需要完整功能:考虑DeepSeek4j等专用Java库灵活性要求高:使用DJL,支持多…

作者头像 李华
网站建设 2026/10/5 10:33:57

Whisper Diarization:智能语音转写与多说话人识别技术指南

Whisper Diarization:智能语音转写与多说话人识别技术指南 【免费下载链接】whisper-diarization Automatic Speech Recognition with Speaker Diarization based on OpenAI Whisper 项目地址: https://gitcode.com/GitHub_Trending/wh/whisper-diarization …

作者头像 李华
网站建设 2026/10/6 15:46:05

从数据准备到模型生成:GPT-SoVITS完整流程拆解

从数据准备到模型生成:GPT-SoVITS完整流程拆解 在语音交互日益普及的今天,我们早已不再满足于机械、千篇一律的“AI音”。无论是虚拟主播深情并茂地讲述故事,还是智能助手用熟悉的声音提醒日程,个性化语音合成(TTS&…

作者头像 李华
网站建设 2026/10/5 10:34:11

GPT-SoVITS支持多语言吗?实测结果来了!

GPT-SoVITS支持多语言吗?实测结果来了! 在虚拟主播、AI配音和个性化语音助手日益普及的今天,一个关键问题摆在开发者面前:我们能否用一段中文录音,让同一个声音自然地说出英文、日文甚至法语? 这不再是科…

作者头像 李华
网站建设 2026/10/5 10:48:42

自媒体人福音:用GPT-SoVITS生成专属播客语音

自媒体人福音:用GPT-SoVITS生成专属播客语音 在内容创作进入“音频红利期”的今天,越来越多的自媒体人开始尝试将文字、视频脚本转化为播客或有声节目。但现实是,高质量语音内容的制作往往卡在“声音”这一环——请专业配音成本高&#xff0c…

作者头像 李华