🧠
AI 模型
tomai.uk 的每一项 AI 功能都运行在具体、公开的模型之上——绝不含糊其辞。本页面列出每个模型、它驱动哪些功能、以及在哪里运行。模型变更时我们会同步更新本页。
最后更新: 2026-08-15
文本 AI:GLM-5.3-Flash
所有基于文本的 AI 工具——命理占卜(塔罗、星座、紫微斗数等)、AI 写作、AI 内容检测、AI 翻译,以及守护 AI 图片生成的提示词安全筛查——均由智谱 glm-5.3-flash 模型驱动(open.bigmodel.cn)。文本处理在 Cloudflare 边缘网络上运行。
图片分析:GLM-5.3-Flash
手相与面相通过 glm-5.3-flash 分析您上传的照片——原生多模态模型,一次完成读图与报告撰写(智谱,open.bigmodel.cn)。
图像生成:豆包 Seedream 5.0 Pro
AI 图片生成器使用字节跳动火山方舟平台的豆包 Seedream 5.0 Pro(doubao-seedream-5-0-pro-260628)生成图片。
看图配文:LLaVA 1.5 7B
AI 配文工具使用 LLaVA 1.5 7B 理解图片(@cf/llava-hf/llava-1.5-7b-hf,Cloudflare Workers AI 上运行的开源模型),再由 glm-5.3-flash 撰写文案。
语音识别:Qwen3-ASR
AI 字幕使用开源的 Qwen3-ASR 模型在我们的 VPS 上转录音频。该功能当前在网站上暂停服务。
OCR:Tesseract
图片转文字与 OCR 工具使用开源 Tesseract OCR 从图片和 PDF 中读取文字。免费工具完全在您的浏览器中运行;云端 OCR 工具在我们的 VPS 上运行。
本页面的更新机制
模型会随供应商发布新版本而变化,我们也可能更换供应商。每当某功能的底层模型变更,我们都会更新本页面以及该工具页面上显示的模型。