LANGUAGE-SPECIFIC AI · TEACHER RESEARCH GUIDE

七语种专门大模型与工具调研

给俄语、法语、韩语、西班牙语、日语、阿拉伯语与德语教师的入口、简评和选用指南。

核查日期:2026 年 10 月 3 日 · 53 个语种条目 · 官网、开发者模型卡与研究论文优先

这是资料型调研与选型简评,不是 53 项全部实测后的排行榜。本次核查了语言定位、公开入口、模型资源和部分使用条件,未逐项注册、付费、部署或提交统一语言测试题。下文“适合考察”是基于资料的教学用途判断。

“有公众入口”仅表示官方提供网页/App/演示路径,不代表已经验证中国境内网络、手机号、账号或付款方式可用。抓取失败也不等同于停服。每项均注明核查深度。

先理解“专属”的边界

本报告保留三类:① 明确面向该语言的专门模型;② 以该语言为核心的双语/多语种模型;③ 对该语言有可核查训练优化的衍生模型。仅仅“支持七种语言”或“公司来自该国”不足以入选。

在语言上专门,并不意味着只能处理一个学科,也不意味着专为外语教学训练。反过来,基于 Qwen、Llama、Mistral 做了有证据的语言适配,可以入选;仅把通用模型套上本地语言界面则不能据此入选。

统计口径:53 是便于教师查找的语种条目数,包含模型家族、代表型号及产品线,并非 53 个独立网站。Occiglot 的三种语对分别归档;ALIA 与 Salamandra 为相关生态;同一家族的大小版和量化版未逐一凑数。此为尽可能广泛的重点清单,不声称穷尽所有社区衍生模型。

教师从哪里开始

语种个人先检查的路径有技术团队时重点考察
俄语先看 Alice AI;GigaChat 先检查地区与账号资格T-lite/T-pro、Vikhr、Saiga
法语本次未确认成熟、无门槛的专属公众聊天入口Luciole、CroissantLLMChat;Lucie 公开站暂停
韩语Solar Playground 需账号;定位为韩语优化扩展项HyperCLOVA X/Studio、EXAONE、Kanana
西班牙语可靠清单以模型为主;LINCE 在线试玩未验证ALIA/Salamandra、LatamGPT、RigoChat
日语PLaMo 翻译;PLaMo Chat 有居住地和年龄条件Swallow、Sarashina、LLM-jp、ELYZA
阿拉伯语Fanar、Jais Chat、HUMAIN Chat、Mubeen 的官方入口Falcon-Arabic、SILMA、AceGPT
德语本次未确认符合严格筛选的成熟公众聊天入口SauerkrautLM、DiscoLeo、LeoLM、Occiglot

推荐顺序依据语言定位与上手路径,不是对回答质量的实测排名。各项依据与官网在下方卡片中。

俄语

7 个条目

公众产品较明确,但 GigaChat 的俄罗斯账号与地区门槛会影响中国教师使用;Alice AI 可作为优先检查的入口。学校部署可考察 T-lite、Vikhr、Saiga。

01

GigaChat(ГигаЧат)

Sber/俄罗斯

俄语俄语核心公众入口

纳入依据 官方将其定位为俄语神经网络,并强调俄语对话与文本处理;属于俄语核心的综合助手,并非只会俄语。

资料型简评 适合优先考察俄语写作改写、课堂对话和文化材料生成。对中国境内教师,最大的实际障碍是注册及地区要求,不能直接推荐为无门槛免费工具。

怎么打开 打开 giga.chat/portal → 进入聊天 → 手机或 Sber ID 登录。官方帮助说明注册 Sber ID 需要俄罗斯 SIM 卡,FAQ 还写明俄罗斯 IP 条件。

费用与门槛 存在免费/增值使用方式;API 单独计费。具体额度、付费功能以当前账号页面为准。

核查到哪一步 官方产品页及帮助已核查;未完成登录或生成测试。

02

Alice AI/YandexGPT

Yandex/俄罗斯

俄语俄语核心公众入口

纳入依据 YandexGPT 家族针对俄语发展;公众端为 Alice AI。当前 API 文档同时列有 Alice AI LLM 与 YandexGPT,不能把今天的网页固定称为某一旧版本。

资料型简评 是俄语老师可优先尝试的公众入口,适合材料改写、情境对话和查找俄语信息。让它给出处再核对原文;搜索能力与底层模型的语言能力应分开评价。

怎么打开 打开 alice.yandex.ru → 输入俄语问题;登录 Yandex 账号可创建和保存聊天。开发者从 Yandex AI Studio 查看模型与 API。

费用与门槛 网页有免费入口与增值功能;API 按平台收费。海外注册与手机号验证未实测。

核查到哪一步 聊天首页已读取,显示登录与新聊天;未发送测试题。

03

T-lite/T-pro

T-Tech/俄罗斯

俄语俄语适配技术部署

纳入依据 以 Qwen 等基础模型做俄语适配;T-pro 2.0 的报告说明西里尔字母分词优化、俄语数据及推理训练。官方目录已有多个版本,按家族合并。

资料型简评 适合有技术支持的院系搭建俄语助手,比较文本改写与复杂任务。小型 T-lite 更适合作为部署起点;T-pro 的俄语推理表现不能直接等同于语法讲解准确率。

怎么打开 打开官方模型目录 → 选择 it/Instruct 版本 → 由技术人员部署。T-pro 2.0 论文另提供 Streamlit 演示地址,但本次无法确认演示正常运行。

费用与门槛 公开权重;T-pro 2.0 标注 Apache-2.0。运行硬件和云端推理可能收费,其他版本逐项看许可。

核查到哪一步 模型卡、目录、论文已核查;演示未通过可用性验证。

04

Vikhr(Вихрь)

Vikhr 社区

俄语俄语适配技术部署

纳入依据 开发团队明确专注俄语化模型,发布不同基础模型的俄语指令版本;例如 Vikhr-Llama-3.2-1B-Instruct 明确针对俄语处理。

资料型简评 适合研究俄语本地助手、教材问答和小模型教学实验。型号很多,应按具体模型卡判断能力,不能把某个 RAG 或语音版本的特征推广到整个家族。

怎么打开 进入官方组织页 → Models → 选 Instruct 与合适体量 → 按模型卡部署;Spaces 演示可能暂停或报错。

费用与门槛 权重公开;许可随版本及基础模型不同,计算成本另计。

核查到哪一步 官方组织页及代表模型已核查;未部署。

05

Saiga(Сайга)

Ilya Gusev/社区

俄语俄语适配技术部署

纳入依据 作者将该系列定义为不同基础大模型的俄语微调版本,包含 Llama 等路线。

资料型简评 适合院系在本地测试俄语对话、摘要和练习题草稿。社区方案可控性较强,但不同版本年代和效果差异大;不应默认胜过最新通用模型。

怎么打开 打开作者 Saiga collection → 选具体指令模型或其量化版本 → 按卡片说明运行;在线 Space 只作为可选演示。

费用与门槛 公开权重,基础模型许可各异;本地部署需计算资源。

核查到哪一步 作者合集已核查;部分 Spaces 的状态不同,未逐一生成测试。

06

RuAdapt/RuadaptQwen

RefalMachine 等研究者

俄语俄语适配技术部署

纳入依据 通过俄语词表、分词与继续训练适配基础大模型;已有 Qwen3 俄语指令及 GGUF 版本。与同名俄语简化语料库不是同一类资源。

资料型简评 适合俄语本地推理与分词效率研究,也可作为课堂助手的候选底座。其工程效率改进不代表变格、重音和体的解释已达到教学标准。

怎么打开 从已核查的 RuadaptQwen3-4B-Instruct-GGUF 页面下载兼容版本,交给支持该架构的本地运行软件加载。

费用与门槛 公开权重;查看具体文件对应许可,运行成本另计。

核查到哪一步 代表模型卡已核查;未本地运行。

07

ruGPT/ruGPT-3.5-13B

AI Forever/Sber 研究生态

俄语俄语核心研究/历史

纳入依据 俄语生成式预训练模型路线,代表模型 ruGPT-3.5-13B 的权重仍有公开页面。

资料型简评 适合了解俄语大模型发展和文本续写实验。基础模型不是现成教学聊天工具;普通老师的首次体验宜放在 Alice AI 或具备条件的 GigaChat。

怎么打开 打开模型卡 → 阅读生成代码与训练定位 → 技术部署;不要把 Base 模型当作已经调好的问答助手。

费用与门槛 公开权重,具体使用遵守模型卡许可;需自行承担计算成本。

核查到哪一步 模型页面已核查;列为研究补充。

法语

7 个条目

符合严格语言筛选的资源以研究模型为主。本次未确认一个可直接推荐给所有教师的成熟法语专属公众聊天站;不能为了凑入口把 Le Chat 当成法语专属。

08

Lucie

OpenLLM France/LINAGORA

法语法语核心暂停入口

纳入依据 其训练资源明确以法语为中心,同时包含英语等欧洲语言;属于法语重点的多语种模型。

资料型简评 适合介绍开放法语模型与训练数据透明度。公众聊天站目前仍写“平台未开放”,不能作为老师立即上手的聊天网站;模型下载与网站关闭是两回事。

怎么打开 查看 lucie.chat 的当前通知;需要使用模型则进入 OpenLLM-France,选 Lucie-7B-Instruct 等指令版本并部署。

费用与门槛 模型权重公开;公众站当前非开放聊天。部署成本及具体许可另查对应版本。

核查到哪一步 已读取聊天站的未开放通知;LINAGORA 另一宣传页有“可试用”说法,本报告以实际入口通知为准。

09

Luciole

OpenLLM France

法语法语核心技术部署

纳入依据 官方提供 1B/8B/23B 等系列;8B 模型卡说明基础模型约 30% 法语训练数据,但其 Instruct 1.1 后训练几乎全部使用英语。

资料型简评 值得列入法语院系的本地试用候选,尤其是小体量版本。法语预训练占比是纳入依据,不能据此断言法语指令遵循最好,需重点测试法语输出稳定性。

怎么打开 进入 Luciole-8B-Instruct-1.1 或官方合集 → 选 Instruct 及合适规格 → 部署;模型仓库不是公众聊天页。

费用与门槛 公开权重;依各版本许可使用,计算成本另计。

核查到哪一步 官方当前模型卡及版本列表已核查。

10

CroissantLLM/CroissantLLMChat

CroissantLLM 研究团队

法语双语专门技术部署

纳入依据 法英双语设计,预训练使用 1:1 英法比例,并配套双语分词器及微调数据;有约 1.3B 的 Chat 版本。

资料型简评 适合轻量法英对照、短文改写实验与模型教学。体量小、便于研究,但长篇论证和细致纠错不宜未经审核直接用于课堂。

怎么打开 打开 CroissantLLMChat-v0.1 → 依模型卡加载;优先选 Chat,基础 CroissantLLMBase 用于研究或进一步训练。

费用与门槛 开放模型资源;本地或云端运行仍有资源成本。

核查到哪一步 团队说明与 Chat 模型卡已核查;未实测生成。

11

Claire

LINAGORA/OpenLLM France

法语法语专门研究/历史

纳入依据 以法语自然口语对话数据适配,研究定位是对话建模;原始 Claire-7B-0.1 主要用于续写对话,并非成熟问答助手。

资料型简评 适合口语语体、犹豫重复和真实对话特征的研究。若目标是规范书面语批改,它的自然口语取向未必合适;有指令变体时也需单独评价。

怎么打开 进入模型卡或官方合集 → 区分基础版、FR-Instruct 与 Apache 变体 → 技术运行。

费用与门槛 Claire-7B-0.1 为 CC-BY-NC-SA 4.0;另有不同许可变体,不能混用许可结论。

核查到哪一步 官方模型卡已核查;列为研究补充。

12

Vigogne/Vigo

Bofeng Huang/社区

法语法语适配技术部署

纳入依据 项目明确为法语指令跟随与聊天模型,包含 Llama 系列及其他基础模型的法语适配。

资料型简评 适合作为法语微调路线的代表,测试简单问答和对话。部分版本较早,不应把旧模型的历史排名当作当前质量;授课用途需重新测评。

怎么打开 从作者 GitHub 的模型表进入具体 Chat/Instruct 仓库 → 按对应模板加载;避免误下只含适配器的文件。

费用与门槛 各代基础模型与许可不同,早期研究版尤其要核对;部署成本另计。

核查到哪一步 作者项目与合集已核查;未确认稳定公众演示。

13

Gaperon

Inria Paris ALMAnaCH

法语双语专门技术部署

纳入依据 面向法语、英语与代码的生成模型系列;Gaperon-1125-8B 为官方说明的 8B 主要版本。

资料型简评 适合对法英双语预训练和开放研究感兴趣的教师团队。应先确认具体版本的聊天模板与指令能力,不能把预训练发布直接当成完整的教学助手。

怎么打开 进入官方 Gaperon-1125-8B 模型卡 → 查训练定位、使用说明及相关版本 → 技术部署。

费用与门槛 公开研究资源;许可以所下载版本为准,运行成本另计。

核查到哪一步 论文及 Inria 团队模型卡已核查;未运行。

14

Occiglot 法英指令版

Occiglot Research Collective

法语双语适配技术部署

纳入依据 有明确区分语对的 occiglot-7b-fr-en-instruct,并不是笼统的“支持法语”。

资料型简评 适合法英双语对话和欧洲语言适配研究。作者说明部分评测用机译数据及英语提示,因此不能据排行榜直接认定法语教学优势。

怎么打开 打开 fr-en-instruct 模型卡 → 按说明本地/服务器部署;不要下载德英或西英版本代替。

费用与门槛 公开权重,许可及计算成本依具体部署。

核查到哪一步 官方法英模型卡已核查。

韩语

7 个条目

本土语言优化证据充分,但产品入口变化很快。CLOVA X 已关闭;当前应区分开发平台、开放模型、Kakao 内功能和通用模型代理产品。

15

HyperCLOVA X/CLOVA Studio

NAVER

韩语韩语核心开发平台

纳入依据 官方明确强调韩语文化语境、高质量韩语训练和韩语优化分词;同时支持其他语言。

资料型简评 韩语写作、敬语转换与文化语境任务值得重点考察。须区分仍在发展的模型/平台与旧聊天产品:CLOVA X 已于 2026-04-09 结束服务。

怎么打开 从 CLOVA Studio 文档进入 NAVER Cloud 申请服务、使用 Playground/API;也可从官方开放模型项目选择 SEED 系列部署。不要再把旧 CLOVA X 当成可用入口。

费用与门槛 开发平台申请与计费条件以 Naver Cloud 为准;开放权重按各版本许可使用。

核查到哪一步 关闭公告、模型官网及 Studio 说明已核查;未完成云账号申请。

16

EXAONE 系列

LG AI Research

韩语韩语核心技术部署

纳入依据 EXAONE 3.5 明确为韩英双语;后续 4.0、4.5、K-EXAONE 向多语种/多模态扩展。官方目录已列 K-EXAONE 2.0,不将全系列都称作韩语专用。

资料型简评 有技术支持时,可从较小指令版试做韩语摘要、读解与写作反馈。超大 K-EXAONE 不适合当作教师笔记本的默认安装选择;ChatEXAONE 产品也不等于人人可用的公开聊天。

怎么打开 进入 LG 官方模型目录 → 根据硬件和语言定位选择 Instruct 版本 → 按模型卡运行。对网页体验,可从 LG 的 EXAONE 官网查看 Showroom 当前安排。

费用与门槛 不同代许可证有差异;3.5 的研究开放不能推广为全系列无限制商用。自行部署或托管会产生成本。

核查到哪一步 官方模型目录与研究报告已核查;未验证 Showroom 登录后功能。

17

Kanana 模型家族

Kakao

韩语韩语核心技术部署

纳入依据 Kakao 自研语言模型,官方发布说明强调韩语推理和韩语环境;AI Hub 提供模型下载。

资料型简评 适合韩语本土语境、对话和多模态研究。要区分 Kanana 模型、KakaoTalk 内 Kanana 功能及 ChatGPT for Kakao;后者不属于本报告的专属模型。

怎么打开 从 Kakao AI Hub 的“模型下载”进入官方仓库部署。产品体验从 Kanana 官网查看邀请、设备支持与 KakaoTalk 条件;不承诺有通用独立网页聊天。

费用与门槛 开放模型和消费产品规则分别核对;未核实中国账号可用性或收费。

核查到哪一步 AI Hub 当前页面与 Kanana 支持设备/邀请说明已核查,旧独立 App 信息不作为现状依据。

18

Solar(优先考察韩语优化版本)

Upstage

韩语韩语优化/多语种开发平台

纳入依据 官方有韩语流畅度强化、韩日语能力提升的发布说明;但现行 Solar 已走向多语种与通用代理任务,属于扩展候选而非韩语唯一专属。

资料型简评 Playground 比纯模型下载更便于教师试用,可考察韩语改写和长文摘要。必须记录实际选择的型号,不能把不同代 Solar 的结果混在一起比较。

怎么打开 进入 Upstage Console 的 Chat Playground → 注册/登录 → 选择当前 Solar 型号。API 可供学校接入自有工具。

费用与门槛 API/云端用量通常需计费;当前试用额度、付款要求以控制台为准,本次未登录确认。

核查到哪一步 官方 Playground 引导与当前模型目录已核查。

19

EEVE Korean/YanoljaNEXT-EEVE

Yanolja

韩语韩语适配技术部署

纳入依据 通过词表扩展等方式加强韩语;旧 EEVE-Korean-Instruct-10.8B-v1.0 地址现重定向到 YanoljaNEXT-EEVE-Instruct-10.8B。

资料型简评 适合韩语本地助手和词表适配研究。属于较早但可复现的候选,不能以发布时的排行榜第一推断今天最强。

怎么打开 进入当前模型卡 → 选择指令版 → 按说明部署;旧名称可以作为检索别名。

费用与门槛 该代表模型标注 Apache-2.0;计算、托管成本另计。

核查到哪一步 已核查旧链接到新模型名的重定向与许可。

20

KULLM(구름)

高丽大学 NLP & AI 团队

韩语韩语适配技术部署

纳入依据 项目明确为韩语特化 LLM,官方仓库提供 KULLM3 的资源和使用说明。

资料型简评 适合高校研究、韩语指令跟随与对话实验。仓库明确提醒幻觉、重复输出及提示模板问题,语言老师应重点检查自然度和纠错准确性。

怎么打开 打开 GitHub → 按 README 找到模型 → 采用官方 system prompt 和使用代码部署。

费用与门槛 仓库标注 Apache-2.0;模型具体版本与基础模型要求仍需核对,计算成本另计。

核查到哪一步 官方代码仓库已核查;未本地推理。

21

KoAlpaca

Beomi/社区

韩语韩语适配研究/历史

纳入依据 针对韩语指令理解的开放项目,包含不同基础模型路线。

资料型简评 适合解释“如何把基础模型训练成韩语助手”,以及做可复现的早期模型对比。并非当下课堂使用的优先质量选择。

怎么打开 打开项目 README → 确认模型版本、运行方式与数据用途;公众演示是否在线需另查。

费用与门槛 代码、数据、基础模型的许可分别核对;部署成本另计。

核查到哪一步 作者仓库已核查;历史研究补充。

西班牙语

7 个条目

需要同时关注西班牙和拉美,而非只查西班牙公司。ALIA/Salamandra 与 LatamGPT 的文化和地区定位不同,多数可靠路径仍是院系技术部署。

22

ALIA-40B Instruct

BSC/西班牙公共 AI 项目

西班牙语西语核心/区域多语种技术部署

纳入依据 ALIA 为西班牙语及共同官方语言的公共基础设施;目前官方模型卡已有 ALIA-40b-instruct-2601,不能沿用“只有基础版”的旧说法。

资料型简评 适合西班牙语言与本土知识资源建设,院系可考察其教材问答与文本改写。40B 部署有一定门槛,优先由学校技术团队提供统一入口。

怎么打开 打开 ALIA Kit → 文本模型 → ALIA-40b-instruct-2601;模型卡推荐通过 HF Inference Endpoints 部署,也可自行部署。

费用与门槛 模型卡标注 Apache-2.0;托管端点和硬件收费另计。

核查到哪一步 政府门户、官方资源目录及指令模型卡已核查。

23

Salamandra Instruct

BSC/ALIA 生态

西班牙语区域多语种技术部署

纳入依据 欧洲多语种模型家族,具有西班牙及区域语言资源背景;本报告将它作为西语重点生态补充,不定义为纯西语专属。

资料型简评 2B/7B 等指令版适合较小规模本地教学实验。与 ALIA-40B 有同一项目生态关系,本条便于按体量选择,不是另一家独立聊天平台。

怎么打开 从 BSC-LT/salamandra-7b-instruct 模型卡或 ALIA Kit 选择 Instruct 版本 → 部署;基础版和 guard 内容审核版不是同一用途。

费用与门槛 公开权重;依具体模型卡许可,运行及托管费用另计。

核查到哪一步 官方目录、7B Instruct 模型卡与论文已核查。

24

LatamGPT

CENIA 及拉美合作机构

西班牙语地域语言适配技术部署

纳入依据 Llama 3.1 70B 经拉美数据继续预训练及指令微调,重点覆盖拉美文化和语言变体;支持西语、葡语和英语。

资料型简评 是拉美西语教学特别值得关注的模型,适合设计地区表达、文化背景与语体对照任务。区域定位并不保证覆盖每个国家,70B 也不是轻量桌面工具。

怎么打开 进入 latamgpt.org 的 Resources → 下载 Llama-3.1-70B-LatamGPT-SFT-1.0 → 技术部署;不要把新闻发布页面当成现成聊天窗口。

费用与门槛 公开权重,继承 Llama 3.1 许可;模型卡说明半精度仅权重约需 140GB 显存,量化也需另做资源评估。

核查到哪一步 官方资源页及已发布模型卡已核查;并非“尚未发布”。

25

RigoChat-7b-v2

IIC/西班牙

西班牙语西语适配技术部署

纳入依据 基于 Qwen2.5-7B-Instruct,以西语偏好优化和上下文问答为重点,官方明确西语定位。

资料型简评 较适合“给定教材后回答问题”的西语课堂助手试验。官方也只称部分任务有改善,不宜夸成全面超越基础模型;部署时应测是否乱补教材外信息。

怎么打开 打开 IIC 模型卡 → 选原始权重或官方链接的 GGUF → 本地部署;商业服务可查卡片所列 AWS Marketplace 路线。

费用与门槛 公开权重是非商业许可;商业使用需联系 IIC 或其授权服务,不等于无条件免费商用。

核查到哪一步 模型卡、语言定位和许可限制已核查。

26

LINCE-ZERO/LINCE

Clibrain

西班牙语西语专门技术部署

纳入依据 LINCE-ZERO 为以西语指令数据微调的 Falcon-7B;品牌官网明确西语核心定位。

资料型简评 适合展示西语专门微调路径,可试短文生成、改写与简单问答。官网仍带早期 40B 候补宣传,无法据此确认更大版本或在线演示现状。

怎么打开 可靠路径为打开官方 LINCE-ZERO 模型卡部署。官网虽有“Probar LINCE ZERO”文案,本次未核实可工作的生成界面。

费用与门槛 LINCE-ZERO 模型卡为 Apache-2.0;托管/企业服务收费另查。

核查到哪一步 官方模型与宣传页已核查;在线试玩未验证。

27

Ǎguila-7B

BSC/Projecte AINA

西班牙语区域双语优化研究/历史

纳入依据 以西班牙语、加泰罗尼亚语与英语数据适配的生成模型,属于区域语言模型。

资料型简评 适合研究西语与加泰语共存的语言生态及继续预训练。基础版并非现成对话助手,普通老师实际使用宜先考察 ALIA/Salamandra 指令版。

怎么打开 打开 projecte-aina/aguila-7b → 按模型卡进行文本生成或进一步训练。

费用与门槛 公开权重;许可依模型卡,计算成本另计。

核查到哪一步 官方模型卡已核查;研究补充。

28

Occiglot 西英指令版

Occiglot Research Collective

西班牙语双语适配技术部署

纳入依据 具有独立的 occiglot-7b-es-en-instruct 西英适配版本。

资料型简评 适合西英对照和本地语言助手实验。它与法英、德英条目属于同一研究计划下的不同模型,不能累计成三个独立服务商。

怎么打开 进入 es-en-instruct 官方模型卡 → 采用其聊天模板及加载方式运行。

费用与门槛 公开权重;模型许可及部署成本需分别考虑。

核查到哪一步 官方模型卡已核查,未运行生成。

日语

11 个条目

模型生态丰富,公众入口与企业方案的落差也大。翻译产品可先看 PLaMo;部署看 Swallow、Sarashina、LLM-jp 等;ELYZA 旧公开演示已结束。

29

PLaMo/PLaMo 翻译

Preferred Networks

日语日语核心公众入口

纳入依据 独立开发的日语重点模型,并有以该 LLM 为基础的专门翻译产品。

资料型简评 对教师而言,翻译网页的任务更清晰,适合对照译文、分析语体和长文表达。Chat 演示存在明确居住地与年龄条件,不能推荐给所有中国境内教师直接使用。

怎么打开 翻译:打开 translate.preferredai.jp → 文本翻译。聊天:进入 PLaMo Chat;页面要求确认日本居民/法人且 18 岁以上,只有满足条件时使用。

费用与门槛 Chat 页标注免费演示;翻译产品的试用、功能和收费规则以当前页面为准,不能等同长期无限免费。

核查到哪一步 官方翻译页、Chat 条款与平台文档已核查;未登录/提交翻译。

30

ELYZA LLM

ELYZA/KDDI 生态

日语日语适配技术部署

纳入依据 官方明确为日语大模型系列,包含 Llama 等基础模型的日语适配及后续系列。

资料型简评 适合日语摘要、改写和任务遵循的部署候选。最需要更新的是入口信息:官网明确写公开 LLM 演示在 2026 年 5 月结束,不能继续推荐旧体验链接。

怎么打开 进入官方 ELYZA LLM 页面查看 API/合作提供方式;研究与本地使用可从官方历史发布文中的模型链接进入开放权重。

费用与门槛 开放模型按对应基础许可;企业 API/合作方案需咨询,不视作免费公众聊天。

核查到哪一步 已确认演示结束公告;未进行企业服务申请。

31

Swallow

东京科学大学/AIST 等

日语日语适配技术部署

纳入依据 通过日语语料与继续训练强化现有模型,当前官网列有多条后续路线,不只早期 Llama 2。

资料型简评 是院系部署日语助手和开展语言模型对比的重点候选。开放研究资料丰富,便于追踪训练来源;敬语、语用和日语教学等级仍须专门测试。

怎么打开 进入 Swallow 官网 → Highlights/模型发布 → 选当前适当的 Instruct 版本 → 从官方 Hugging Face 下载部署。

费用与门槛 开放权重,许可证继承各路线要求;硬件/托管成本另计。

核查到哪一步 官网与早期训练说明已核查;旧型号页面明确标作旧型。

32

Sarashina

SB Intuitions

日语日语核心技术部署

纳入依据 软银系 SB Intuitions 的日语重点模型家族;Sarashina2.2 有 0.5B/1B/3B 等基础和指令版本,另有企业 API 路线。

资料型简评 较小的指令版适合试做校内日语助手,降低部署门槛。小体量并不保证高级日语语法解释准确,建议先以短文改写、分类和材料辅助为测试任务。

怎么打开 从官方 Sarashina2.2 合集选 Instruct 模型;机构应用可通过 SB Intuitions 官网咨询 Sarashina API。

费用与门槛 开放模型许可按版本;企业 API 为另一服务,需查询申请与报价。

核查到哪一步 官方模型合集及企业新闻目录已核查。

33

tsuzumi/tsuzumi 2

NTT

日语日语核心机构采购

纳入依据 NTT 自研,明确重视日语处理;tsuzumi 2 已有企业文档处理方面的更新。

资料型简评 适合学校机构级日语资料处理、知识库和业务系统评估。对于只想开网页备课的老师,采购与部署门槛高,不列作个人优先试玩工具。

怎么打开 进入 NTT 官方说明 → 通过 NTT 集团服务渠道咨询试用、API 或本地提供方式。

费用与门槛 企业方案,需询价;未核实面向个人的固定免费入口。

核查到哪一步 NTT 产品及 2026 年更新公告已核查。

34

cotomi

NEC

日语日语核心机构采购

纳入依据 NEC 自研模型及 AI 技术体系,官方强调日语与长文能力,提供专用硬件、数据中心及 API 等形式。

资料型简评 适合日语机构文档问答、校务知识库和长文处理方案研究。它的主要定位是机构业务,教师个人无需为了体验语言特色而采购服务器。

怎么打开 从 NEC cotomi 官方页面咨询服务;需要本地方案时查看 Generative AI Appliance Server。

费用与门槛 商业/机构方案,报价依提供方式;不以公开免费下载工具介绍。

核查到哪一步 NEC 当前技术页与提供方式已核查。

35

Takane

Fujitsu

日语日语优化机构采购

纳入依据 富士通的企业日语大模型路线,结合日语性能与行业专门知识;不同版本及底座须单独核对。

资料型简评 适合职业日语、行业文档和机构知识库的合作研究。官方业务评测不能推导为日语外语教学最优,也不应当作个人免费聊天 App。

怎么打开 通过富士通 Takane/领域特化 AI 官方页咨询试用与部署,确认具体模型、服务和合同范围。

费用与门槛 企业服务需询价,未核实公众聊天入口。

核查到哪一步 官方领域特化说明已核查;未试用。

36

LLM-jp

日本国立情报学研究所及合作团队

日语日语核心技术部署

纳入依据 以开放日语大模型为目标的跨机构计划;2026 年 NII 公告发布 LLM-jp-4 相关模型。

资料型简评 适合高校研究、可追溯的日语模型开发与教学实验。模型、数据和评测工具丰富,但这是一套研究生态,教师需要技术团队转成易用界面。

怎么打开 进入 LLM-jp Release → 找到所需生成/指令模型 → 跳转官方模型库;不要将评测工具或 ModernBERT 当作聊天模型。

费用与门槛 开放资源按具体模型条款使用;部署成本另计。

核查到哪一步 官方发布目录与 NII 新模型公告已核查。

37

rinna/Youko 日语模型

rinna

日语日语适配技术部署

纳入依据 rinna 有多代日语生成模型;llama-3-youko-8b-instruct 是可明确识别的日语指令模型。

资料型简评 适合做日语本地对话与改写候选。不要把历史社交聊天机器人“りんな”、企业服务与这一公开模型混成同一个产品或入口。

怎么打开 打开具体 Youko Instruct 模型卡 → 依说明选择运行框架和对话格式 → 部署。

费用与门槛 权重公开,按具体模型许可;计算成本另计。

核查到哪一步 官方模型卡已核查。

38

Rakuten AI 模型家族

Rakuten

日语日语适配技术部署

纳入依据 官方大模型页面明确日语优化,并列有 Rakuten AI 3.0;早期 7B 路线也有公开技术报告。

资料型简评 可用于日本本土应用与日语语言适配研究。不能把乐天所有 AI 产品都当作固定使用同一个日语模型;选择具体权重时注意新型号体量可能非常大。

怎么打开 进入 Rakuten AI 的 Large Language Model 官方页 → 按对应版本获取模型资源与说明 → 技术部署。

费用与门槛 具体版本许可和推理资源需求各异;模型发布不等于免费公众聊天服务。

核查到哪一步 官方当前模型页及早期技术报告已核查。

39

Stockmark LLM

Stockmark

日语日语核心技术部署

纳入依据 Stockmark-2-100B-Instruct 官方模型卡明确日语重点;公司路线注重业务文档与专业知识。

资料型简评 适合专业日语材料与机构文档问答的技术评估。100B 体量决定它更适合学校服务器或托管,普通教师无需将其作为首次本地安装目标。

怎么打开 进入官方模型卡或公司 LLM 页 → 选择指令模型部署,或向公司咨询业务方案。

费用与门槛 公开模型许可与企业服务合同分别处理;计算资源开销较高。

核查到哪一步 公司说明与指令模型卡已核查。

阿拉伯语

7 个条目

本次找到较多明确阿语定位的公众产品线:Fanar、Jais Chat、HUMAIN Chat、Mubeen 等。标准语、地区方言、古典语和元音标注应分别评价。

40

Fanar(فنار)

HBKU/QCRI,卡塔尔

阿拉伯语阿语核心公众入口

纳入依据 明确为阿语生成式 AI 平台,强调阿语文本、语音和文化理解,官方页列出 Chat、App、API 及部分公开模型。

资料型简评 对阿语老师是优先尝试的产品形态,适合课文解释、情境对话和文化素材任务。标准语、方言、语音功能分别检验,不能把平台宣传视作所有方言等强。

怎么打开 从 fanar.qa/en 的“Chat with Fanar”或 App 按钮进入;API 需按官网流程申请。

费用与门槛 公众端当前收费、免费额度和海外注册未完成核验;不标注为永久免费。

核查到哪一步 搜索索引读取到官方产品页及入口说明;直接抓取返回错误,未验证登录或生成,不据此认定停服。

41

Jais/Jais Chat

MBZUAI、Inception、Cerebras

阿拉伯语阿语核心公众入口

纳入依据 阿语核心、兼顾英语的模型家族,现有 Jais 2 相关发布及公众 Jais Chat 网页/App。

资料型简评 可优先测试阿语简化、文化表达和谚语解释,官方产品页也以这些任务展示用途。阿语读写表现与语法分析、全元音标注准确性必须分开判断。

怎么打开 打开 Jais Chat 官网 → Try Jais Chat;也可用页面上的官方 iOS/Android 下载链接。

费用与门槛 登录要求、免费额度、应用商店地区条件未实测;开放权重与公众服务规则分别看。

核查到哪一步 官网当前入口与官方新一代发布已核查;未发送试题。

42

ALLaM/HUMAIN Chat

SDAIA 研发路线/HUMAIN 产品生态

阿拉伯语阿语核心公众入口

纳入依据 ALLaM 为阿英双语模型;HUMAIN Chat 页面及官方开发者 App 说明标注由 ALLAM 34B 驱动。公开 7B preview 与公众聊天并非同一型号。

资料型简评 适合关注沙特及阿语本土文化语境的教师尝试。回答带有本土文化定位,涉及不同地区表达或宗教文本时应与课程材料对照,不能视为泛阿语唯一标准。

怎么打开 从 HUMAIN Chat 登录页进入,可见邮箱登录字段;若要本地部署,可查看已迁至 humain-ai 的 ALLaM-7B-Instruct-preview。

费用与门槛 公众端套餐/地区可用性未登录验证;公开权重的许可与使用限制看模型卡。

核查到哪一步 聊天入口、App 开发者说明和模型重定向已核查;未实测生成。

43

Falcon-Arabic/Falcon-H1-Arabic

TII/阿联酋

阿拉伯语阿语专门公众入口

纳入依据 这两个明确标注 Arabic 的分支针对标准阿语及主要方言;不能把全部 Falcon 通用模型都算阿语专属。

资料型简评 适合阿语语体、方言对照和本地部署研究。官方给出阿语基准结果和演示路线,但“排行榜领先”仍不等于语法教学或方言覆盖全面可靠。

怎么打开 进入官方 Falcon-H1-Arabic 技术博客 → 使用其 Try 链接或下载 3B/7B/34B 等权重;网页演示运行状态需实际打开确认。

费用与门槛 开放权重依版本许可;演示额度未核实,服务器/API 成本另计。

核查到哪一步 官方博客与试用链接说明已核查;未验证演示生成。

44

SILMA-9B-Instruct

SILMA AI

阿拉伯语阿语核心技术部署

纳入依据 明确面向阿语的指令模型,官方 Hugging Face 发布 SILMA-9B-Instruct-v1.0。

资料型简评 适合作为阿语本地助手、文本生成和知识库问答的候选。当前 SILMA 主站还提供语音产品,不能把语音 Playground 自动当成这个文本模型的聊天入口。

怎么打开 从官方 SILMA-9B 模型卡获取权重并部署;若使用厂商在线服务,先确认是否真在调用该文本模型。

费用与门槛 公开权重依模型许可;语音服务订阅与此模型使用不是同一收费项。

核查到哪一步 模型卡与厂商当前服务条款已核查;未部署。

45

AceGPT

FreedomIntelligence 等合作研究团队

阿拉伯语阿语适配技术部署

纳入依据 研究目标明确是阿语语言和文化本地化;有 7B/13B 等路线及 Chat 版本。

资料型简评 适合开展阿语本地化模型的对比研究,也可实验课文问答。它不是经过外语教学认证的工具,较早模型在复杂推理、变音符和方言上的表现需另测。

怎么打开 打开官方 AceGPT Chat 模型卡 → 确认基础许可、模板与依赖 → 技术部署;不要把基础版直接替代聊天版。

费用与门槛 公开权重;使用依对应模型及基础模型许可,计算费用另计。

核查到哪一步 项目论文与代表 Chat 模型卡已核查。

46

Mubeen(مُبين)

MASARAT/沙特

阿拉伯语阿语专门公众入口

纳入依据 官方技术页明确定位为阿语专门模型,侧重语言、语法、文化与传统文本;其公开技术透明度应与开放权重项目分开看。

资料型简评 与阿语教师需求贴近,尤其值得用句法分析、词法和古典文本测试。但当前优势主要来自厂商说明,未据独立对照实测证实,不能写成“最准确的阿语老师”。

怎么打开 进入 mubeen.masarat.sa → 按官网聊天/体验引导;不要误入同名 mubeen.ai(反欺诈产品)或其他同名学习平台。

费用与门槛 公众体验、订阅及 API 具体费用需在注册时确认;未核实全部权重公开。

核查到哪一步 官网及技术页已核查;未完成注册和语言测试。

德语

7 个条目

核心名单主要是开放权重或研究模型。LeoLM、SauerkrautLM、DiscoLeo 适合院系部署试验;LLäMmlein 是严格德语单语路线代表。

47

LeoLM

LAION/Hessian AI 研究生态

德语德语适配技术部署

纳入依据 以德语继续训练与德语指令数据为特色,官方有 German chat 模型。

资料型简评 适合德语语言适配研究和本地教学助手原型。较早型号更适合可复现实验,不能用“德语专门”替代与当前模型的真实质量比较。

怎么打开 打开 LeoLM 模型卡 → 区分基础/Chat 版本与体量 → 使用相应模板部署;70B 并不是普通电脑的默认选择。

费用与门槛 公开权重,基础模型许可适用;计算成本另计。

核查到哪一步 官方 Chat 模型卡已核查。

48

SauerkrautLM

VAGO solutions

德语德语适配技术部署

纳入依据 系列以德语/德英数据微调或继续训练强化基础模型;具体方法随版本不同。

资料型简评 适合德语本地问答、改写和校内材料检索试验。官方目录还包含检索、向量或视觉模型,选择时要认准 Text Generation/Instruct,不能仅凭品牌名判断。

怎么打开 从 VAGOsolutions 组织页选择德语生成模型,例如 Llama-3-SauerkrautLM-Instruct;按需要选官方关联的量化版本。

费用与门槛 不同版本的基础许可不同;1.5B 演示版与 70B 版不能共用一条许可结论。运行成本另计。

核查到哪一步 官方组织页及代表模型卡已核查。

49

DiscoLM German/DiscoLeo

DiscoResearch

德语德语适配技术部署

纳入依据 德语重点模型路线,包含 Mistral 时代 DiscoLM 与后续 Llama3-DiscoLeo-Instruct。

资料型简评 适合院系试做本地德语摘要、问答和写作反馈。优先指定具体指令模型再测从句语序、格与语体,不能从家族名称推断所有型号表现相同。

怎么打开 打开官方 DiscoLeo Instruct 模型卡 → 按其说明部署;兼容的量化版本可减小内存需求。

费用与门槛 公开权重,按具体基础及衍生许可;计算成本另计。

核查到哪一步 官方指令模型卡已核查。

50

EM German

Jan Philipp Harries 等社区作者

德语德语适配研究/历史

纳入依据 以德语指令数据微调 Llama2/Mistral/LeoLM 的早期家族,是后续 DiscoLM 的相关发展路线。

资料型简评 适合了解早期德语指令微调和本地运行方法。不应把它与后续模型包装成互不相关的新工具,也不建议仅凭旧教程将其当首选。

怎么打开 从作者 EM_German README 的型号表选模型与量化格式,按对应模板运行。

费用与门槛 各基础模型许可不同;权重开放并不意味着零运行成本。

核查到哪一步 作者仓库已核查;历史补充。

51

Occiglot 德英指令版

Occiglot Research Collective

德语双语适配技术部署

纳入依据 有专门德英模型及继续训练资源,与其法英、西英版本区分。

资料型简评 适合德英双语和德语本地化研究。跨语言排行榜包含机译与提示语言因素,老师更应使用自己的真实教材测试。

怎么打开 从 Occiglot 官方模型介绍进入 de-en-instruct;基础 de-en 页面可用于核对语言定位和训练信息。

费用与门槛 公开权重;按版本许可,计算成本另计。

核查到哪一步 官方模型目录、德英基础模型与训练说明已核查。

52

LLäMmlein

维尔茨堡大学 LSX 团队等

德语德语专门研究/历史

纳入依据 从头训练的德语单语生成模型系列,官方仓库列 120M/1B/7B,并公开训练资源。

资料型简评 严格“单语专属”筛选下非常有代表性,适合科研和语言模型教学。小型 Base 模型主要做续写或后续训练,不宜直接当成成熟德语对话老师。

怎么打开 打开官方 LLaMmlein 仓库 → 按模型大小查权重、代码与说明 → 技术运行或做进一步指令训练。

费用与门槛 公开研究资源;核对模型和数据的具体许可,运行成本另计。

核查到哪一步 官方仓库及论文已核查。

53

Pharia-1-LLM

Aleph Alpha

德语区域多语种优化技术部署

纳入依据 官方明确说明对德语、法语、西语做文化与语言优化,且有各语言指令训练;属于欧洲多语种重点补充,不是德语单语模型。

资料型简评 适合机构文档、专业语言和受控回答研究。对普通语言教师,技术和授权门槛高于聊天网页;不能把整个 Pharia 企业平台都等同于此公开模型。

怎么打开 从官方 Pharia-1 发布说明进入 control/control-aligned 模型资源;企业部署通过厂商咨询。

费用与门槛 该发布说明明确 Open Aleph License 允许非商业研究及教育使用;商业使用需另核许可。

核查到哪一步 官方语言定位与许可说明已核查。

哪些常见名字没有混入核心清单

看到 Hugging Face 后,下一步做什么

如果你只想直接用:优先选“公众入口”,再按卡片核对账号和地区条件。模型卡的“Use this model”常常只是代码说明,不等于一个已经免费运行的聊天框;“Deploy”可能创建收费计算服务。

如果学校可以协助部署:先选 Chat/Instruct/it 版本,再检查模型架构、许可、聊天模板和硬件。Base/Pretrain 通常侧重续写或训练;GGUF 是常见量化文件格式,不是更强的另一款模型。

本地软件可以只是运行界面,真正决定语言定位的是装入的具体模型。7B/8B 的 4-bit 权重理论上仅参数约 3.5–4GB,但实际还要加格式开销、上下文缓存与程序内存;不要用这个理论数字承诺“任何普通电脑都能流畅运行”。让技术团队用实际配置验证。

费用分开看:下载权重、模型许可、运行硬件、托管 API、公众 App 订阅是不同项目。公开权重不等于完全开源,也不等于无成本或无限制商业使用。

教师可直接拿去做的快速测评

每个候选模型使用同一套材料,记录日期、精确型号及是否联网。建议每类至少 3 题:① 错句诊断与解释;② 分级改写;③ 语体/礼貌转换;④ 地区文化与变体;⑤ 给定课文后的有依据问答。下面题目是后续实测模板,不是本次模型生成结果。

俄语 · 示例测试题

重点看体、格、搭配和重音;不能只看句子是否流畅。

Объясни разницу между «Я читал книгу» и «Я прочитал книгу» для учащегося уровня B1. Дай три пары примеров и укажи, где выбор вида зависит от контекста. Не ставь ударения, если не уверен.
法语 · 示例测试题

重点看条件句、时态、性数配合,以及口语与书面语是否混淆。

Corrige : « Si j’aurais su, je ne serais pas venu. » Explique la correction pour un niveau B1, puis donne deux exemples. Distingue une erreur grammaticale d’un choix de registre.
韩语 · 示例测试题

重点看敬语对象、语尾和真实场合,避免把所有表达机械升格。

다음 요청을 친구에게, 처음 만난 동료에게, 교수님께 하는 말로 각각 바꿔 주세요: “이 문서 좀 봐 줘.” 각 표현의 높임법과 자연스러운 사용 상황을 설명해 주세요.
西班牙语 · 示例测试题

重点看国家/地区变体、voseo、虚拟式和不能一概而论的文化判断。

Explica el uso de tú, usted y vos. Compara España, México y Argentina sin generalizar a todos los hablantes. Incluye ejemplos naturales y señala qué depende de la región.
日语 · 示例测试题

重点看敬语主体、语用自然度和解释与例句是否一致。

学生が大学の先生に締め切りの延長をお願いする短いメールを書いてください。丁寧だが過剰ではない表現にし、使った敬語を説明してください。不自然な二重敬語は避けてください。
阿拉伯语 · 示例测试题

重点看双数/复数、格标记、元音与分析的一致性;方言另加地区指定题。

أعرب الجملة «إنَّ الطالبينِ مجتهدانِ» إعرابًا موجزًا، واشرح علامات الإعراب. ثم حوّلها إلى جمع المذكر السالم. إذا لم تكن متأكدًا من ضبط كلمة، فصرّح بذلك.
德语 · 示例测试题

重点看从句动词位置、主句倒装、格和解释是否能帮助学习者。

Korrigiere: „Obwohl ich war müde, ich habe den Text gelesen.“ Erkläre die Wortstellung auf B1-Niveau und gib zwei korrekte Varianten, ohne die Bedeutung zu ändern.

每题按 0–2 分记录:语言准确、解释准确、指令遵循、语体/文化恰当、承认不确定,共 10 分。至少两位教师盲评,分歧保留;收费、等待时间、注册与地区限制单列,不混进语言能力分。小样本只能帮助选型,不能据此宣布某模型“该语种最强”。

课堂使用前至少核对例句、译文和知识出处;学生作文先去掉姓名等个人信息。让模型生成初稿,教师保留最终判断。

核查方法、证据与仍未解决的问题

本次按七语种及英语检索语言模型、开发者、公开仓库、官网入口和停服公告;随后回到官方模型卡与产品说明核对。每张卡片附直接来源,尽量以开发者/机构原始材料支撑事实。厂商自报的“最强”“超过某模型”不直接作为本报告的评价结论。

核查发现的冲突采用更贴近实际入口的证据:Lucie 宣传页与聊天站通知冲突时,保留“当前未开放”;CLOVA X 与 ELYZA 依据明确结束公告;模型权重仍存在不等于原聊天服务仍存在。

未完成的实测层:国内不同网络可达性、+86 手机注册、登录后免费额度、支付、语音交互、全部模型的统一语言测试。本报告对未知项直接标注,未把搜索引擎可抓取替代真实可用性,也未创建任何收费资源。

型号按家族组织,选取可核查的代表版本而非保证逐家列出最新最大型号。小众新项目、私有模型、缺乏公开语言优化证据的工具和无限增长的社区量化/合并版本可能不在清单中。