open-calm-small

open-calm-small

高效日语Transformer模型,探索OpenCALM-Small的关键特性

OpenCALM-Small是由CyberAgent, Inc.开发的小型日语语言模型,以160M参数提供高效的语言生成。基于Transformer架构,它在开源库GPT-NeoX上运行,并支持多样化的生成配置。该模型使用来自日本维基百科和常见抓取数据的精选训练数据集,为高质量日语内容生成奠定基础,是开发者处理日语自然语言任务的理想选择之一。

CyberAgent日本语GPT-NeoXHuggingfaceGithub开源项目模型OpenCALM语言模型

OpenCALM-Small 项目介绍

OpenCALM-Small 是由日本 CyberAgent, Inc. 开发的一系列基于解码器的语言模型中的一种。这个项目专注于对日语数据集进行预训练,从而帮助提升日语文本生成的能力。

模型描述

OpenCALM-Small 隶属于 OpenCALM 模型系列,这是一套仅使用解码器的语言模型。模型采用了现代化的变压器架构,适用多种自然语言处理任务。其开发目的是为业界和学术界提供一个精炼而功能强大的日语语言模型。

如何使用

用户可以通过 Python 代码,利用 transformers 库直接加载并使用这一模型。以下是一个简单的使用示例:

import torch from transformers import AutoModelForCausalLM, AutoTokenizer model = AutoModelForCausalLM.from_pretrained("cyberagent/open-calm-small", device_map="auto", torch_dtype=torch.float16) tokenizer = AutoTokenizer.from_pretrained("cyberagent/open-calm-small") inputs = tokenizer("AIによって私達の暮らしは、", return_tensors="pt").to(model.device) with torch.no_grad(): tokens = model.generate( **inputs, max_new_tokens=64, do_sample=True, temperature=0.7, top_p=0.9, repetition_penalty=1.05, pad_token_id=tokenizer.pad_token_id, ) output = tokenizer.decode(tokens[0], skip_special_tokens=True) print(output)

模型详情

OpenCALM-Small 是一种变压器语言模型,具有约 1.6 亿参数。它拥有 12 层网络结构,每层维度为 768 并配备 12 个注意力头。这使得它能够高效地处理和生成日语文本。

此外,OpenCALM 家族中还包括其他规模更大的模型,如:

  • OpenCALM-Medium:400M 参数,24 层
  • OpenCALM-Large:830M 参数,24 层
  • OpenCALM-1B:1.4B 参数,24 层
  • OpenCALM-3B:2.7B 参数,32 层
  • OpenCALM-7B:6.8B 参数,32 层

这些模型提供了不同的选择来适应各种应用场景。

开发信息

  • 开发者: CyberAgent, Inc.
  • : 使用 GPT-NeoX 框架开发
  • 语言: 日语
  • 许可: Creative Commons 署名-相同方式共享 4.0 国际许可证 (CC BY-SA 4.0)

训练数据集

模型的训练主要基于两个重要的日语数据集:

  • 大规模的 Wikipedia 数据集
  • 来自 Common Crawl 的日语文本

作者信息

OpenCALM-Small 项目的主要贡献者是 Ryosuke Ishigami

引用格式

对于使用或研究本模型时需引用以下格式:

@software{gpt-neox-library, title = {{GPT-NeoX: Large Scale Autoregressive Language Modeling in PyTorch}}, author = {Andonian, Alex and Anthony, Quentin and Biderman, Stella and Black, Sid and …}, url = {https://www.github.com/eleutherai/gpt-neox}, doi = {10.5281/zenodo.5879544}, month = {8}, year = {2021}, version = {0.0.1}, }

OpenCALM-Small 作为一个创新的语言模型,对于在日语自然语言处理领域的应用和研究进展都提供了宝贵的支持。通过该模型,用户能够更为高效地探索和应对各种语言生成任务。

编辑推荐精选

Vora

Vora

免费创建高清无水印Sora视频

Vora是一个免费创建高清无水印Sora视频的AI工具

Refly.AI

Refly.AI

最适合小白的AI自动化工作流平台

无需编码,轻松生成可复用、可变现的AI自动化工作流

酷表ChatExcel

酷表ChatExcel

大模型驱动的Excel数据处理工具

基于大模型交互的表格处理系统,允许用户通过对话方式完成数据整理和可视化分析。系统采用机器学习算法解析用户指令,自动执行排序、公式计算和数据透视等操作,支持多种文件格式导入导出。数据处理响应速度保持在0.8秒以内,支持超过100万行数据的即时分析。

AI工具酷表ChatExcelAI智能客服AI营销产品使用教程
TRAE编程

TRAE编程

AI辅助编程,代码自动修复

Trae是一种自适应的集成开发环境(IDE),通过自动化和多元协作改变开发流程。利用Trae,团队能够更快速、精确地编写和部署代码,从而提高编程效率和项目交付速度。Trae具备上下文感知和代码自动完成功能,是提升开发效率的理想工具。

AI工具TraeAI IDE协作生产力转型热门
AIWritePaper论文写作

AIWritePaper论文写作

AI论文写作指导平台

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

AI辅助写作AI工具AI论文工具论文写作智能生成大纲数据安全AI助手热门
博思AIPPT

博思AIPPT

AI一键生成PPT,就用博思AIPPT!

博思AIPPT,新一代的AI生成PPT平台,支持智能生成PPT、AI美化PPT、文本&链接生成PPT、导入Word/PDF/Markdown文档生成PPT等,内置海量精美PPT模板,涵盖商务、教育、科技等不同风格,同时针对每个页面提供多种版式,一键自适应切换,完美适配各种办公场景。

AI办公办公工具AI工具博思AIPPTAI生成PPT智能排版海量精品模板AI创作热门
潮际好麦

潮际好麦

AI赋能电商视觉革命,一站式智能商拍平台

潮际好麦深耕服装行业,是国内AI试衣效果最好的软件。使用先进AIGC能力为电商卖家批量提供优质的、低成本的商拍图。合作品牌有Shein、Lazada、安踏、百丽等65个国内外头部品牌,以及国内10万+淘宝、天猫、京东等主流平台的品牌商家,为卖家节省将近85%的出图成本,提升约3倍出图效率,让品牌能够快速上架。

iTerms

iTerms

企业专属的AI法律顾问

iTerms是法大大集团旗下法律子品牌,基于最先进的大语言模型(LLM)、专业的法律知识库和强大的智能体架构,帮助企业扫清合规障碍,筑牢风控防线,成为您企业专属的AI法律顾问。

SimilarWeb流量提升

SimilarWeb流量提升

稳定高效的流量提升解决方案,助力品牌曝光

稳定高效的流量提升解决方案,助力品牌曝光

Sora2视频免费生成

Sora2视频免费生成

最新版Sora2模型免费使用,一键生成无水印视频

最新版Sora2模型免费使用,一键生成无水印视频

下拉加载更多