Ollama更新到v0.3.4
来源:互联网
时间:2026-08-22 14:28:24
Ollama v0.3.4 来了,这次更新把重点放在了嵌入(Embedding)模型上。先别急着翻版本号,直接看干货——新模型、新API、几个小修复,都挺实在。

引入新的嵌入模型
这次一口气新增了三款嵌入模型,各有各的看家本领:
- :来自BAAI(北京智源研究院)的大型嵌入模型,主打“多功能、多语言、多粒度”——说白了,就是灵活,啥场景都能上。
BGE-M3
- :同样是大型嵌入模型,但训练语料以英语为主,适合纯英文文本的深度语义理解。
BGE-Large
- :一个多语言嵌入模型,训练数据覆盖了50多种语言的平行语料,跨语言场景下相当好用。
Paraphrase-Multilingual
新嵌入API支持批处理
Ollama 现在新增了 /api/embed 接口,专门用来生成嵌入。调用方式很简单,直接发一个POST请求就行,比如:
curl http://localhost:11434/api/embed -d '{"model": "all-minilm","input": ["Why is the sky blue?", "Why is the grass green?"]}'
这个新接口带来了几个实用特性:
- :一次请求可以生成多个文档的嵌入,省去来回调用的麻烦。
批量处理
- :返回的嵌入向量会做标准化处理,相似度计算结果更稳定可靠。
标准化嵌入
- :新增了截断参数,如果设置为
截断控制
false,遇到超长文本会直接报错——等于给了你一个保护机制,避免模型默默截断导致结果偏差。 - :响应里带上了
统计指标
load_duration、total_duration和prompt_eval_count,方便做性能分析和调优。
其他变更内容
除了嵌入模型和API,还有几个值得关注的修复和改进:
- 修复了Windows上初始下载速度缓慢的问题——Windows用户应该能感受到明显提升。
- NUMA支持现在由Ollama自动检测,不用手动配置,性能会更好。
- 修复了
/api/embed偶尔返回嵌入结果顺序错乱的问题——之前遇到乱序的可以升级试试。
一句话总结:如果你频繁用到嵌入模型做语义搜索或聚类,这次更新值得立刻升级。
-
- 关于宇宙的好的网名有哪些
- 角色扮演 | 1
- 网名