每天听简报,了解最新科技、AI、软件资讯
德国人工智能公司Aleph Alpha的Kolibri开放了模型权重,专门面向英语和德语。按官方说明,它总共有约七百八十亿参数,每个词元实际激活约三十五亿,权重采用Apache二点零许可。德语占预训练词元的百分之二十一点三。团队发现,用英语数据的长词过滤规则,会误删德语行政文本,因为德语常把多个词拼在一起。他们重新调了过滤参数,还把已有德语文档改写成问答和百科体,增加同一知识的表达方式。官方把政务、工业和航空列为目标场景,强调客户可自行部署。这种语言与场景取舍,比单纯追求更大模型更具体。
进度保存在本设备 · 登录同步