来自 Google 的最先进的图像 + 文本输入模型,采用与创建 Gemini 模型相同的研究和技术构建

985.2K 下载量

62

4 分叉

功能

视觉输入

最低系统内存

2GB

标签

4B
gemma3

README

gemma 3 4b it,由 Google 提供

支持 128k token 的上下文长度,最大输出 8192。

多模态支持,图像标准化为 896 x 896 分辨率。

Gemma 3 模型非常适合各种文本生成和图像理解任务,包括问答、摘要和推理。

需要最新(当前为测试版)的 llama.cpp 运行时。

来源

此模型使用的底层模型文件

© . This site is unofficial and not affiliated with Element Labs, Inc.