功能概览
YomiTone 是一个面向应用开发者的日语语言标注引擎。它把读音、Furigana、基本形、活用信息 和高低重音整理为可追溯的结构化数据,供阅读器、词典辅助工具和学习软件使用。
网页 v0.1.0
当前网页先发布 YomiTone Markdown 编辑器,提供固定示例、编辑、即时安全渲染、复制、导入 和导出。它不加载辞典,也不把用户内容发送到自动分析服务。Engine 与 SDK 的自动读音、形态 分析和重音标注继续作为独立能力开发,后续优先用于 Mac 本地应用。
单词查询
lookupWord() 可以精确查询:
- 辞典中的表记;
- 辞典中的读音;
- 已支持的动词活用形。
例如查询 食べました 时,结果会说明:
表层:食べました
基本形:食べる
活用:polite_past
组件:食べ / まし / た
读音:たべました
辞书形重音:たべる [2]
表层重音:たべました [3]底层组件不会被丢弃,但面向学习者时,食べました 仍作为一个完整学习单位返回。
返回内容
命中的词条可以包含:
- 一个或多个读音;
- 结构化 Furigana 分段;
- 基本形、词性与活用信息;
- 辞书形高低重音候选;
- 活用形表层高低重音候选;
- 英文释义;
- 数据来源和重音推导过程。
如果没有找到查询词,API 返回 unknown_word warning,而不是捏造一个读音或重音。 如果可以还原活用、但还不能可靠确定表层重音,会返回 unsupported_conjugation_accent,并保留基本形与活用信息。
浏览器数据
浏览器可以采用两种方式:
- 按需模式:查询时只读取命中词的一个分片;
- 安装模式:由用户明确操作,把经过 SHA-256 校验的完整分片包保存到 CacheStorage。
安装状态包含数据版本、数据占用、浏览器总用量、配额和持久存储状态,并可以由用户删除。 辞典安装不等于网站安装;完全断网后重新打开页面仍需要宿主缓存自己的 HTML、JavaScript 和 CSS。
Node.js 数据
Node.js 入口可以直接校验并只读打开本地 SQLite Data Pack,适合服务端、脚本和 Electron 主进程。它不需要 HTTP 服务,也不会加载浏览器完整分片或把辞典打进 npm package。当前 生成的 SQLite 约 390 MiB;同源浏览器分片的逻辑总大小约 555 MiB,两者随数据版本变化。
Node Provider 当前使用 Node 内置 node:sqlite,要求 Node.js 22.13.0 或更高版本。应用 结束使用时应调用 await yomitone.close() 释放数据库连接。
当前适用范围
当前开发预览适合验证:
- 单个辞书形;
- 一段、五段、
する、来る的常见活用还原; - 辞书形与活用形重音的区分;
- 本地数据与 JavaScript SDK 的集成。
目前还不适合:
- 把 R4D 大 BLOB Free CPU 门未通过、且尚未验证真实完整数据的浏览器 Cloudflare 句子分析直接用于生产;
- 被动、使役、可能等复杂活用的可靠表层重音;
- 形容词活用重音;
- 模糊搜索和自动假名转换;
- 依赖尚未公开发布的数据包构建生产应用。
产品只表达词汇和活用层的高低重音,不生成自然句子的语调或声学 F0 曲线。