2025年12月12日,Ollama v0.13.3 版本正式发布。本次更新引入了多款全新模型,并对现有功能进行了优化与修复,为开发者在代码分析、多语言检索以及软件工程领域提供了更高效的支持。
一、全新模型
1. Devstral-Small-2
• 24B 参数模型 • 擅长使用工具探索代码库 • 支持多文件编辑 • 为软件工程类智能代理提供强大能力支持
2. rnj-1 • 8B 参数开源权重、稠密模型 • 由 Essential AI 从零开始训练 • 针对代码及 STEM(科学、技术、工程、数学)领域优化 • 性能可与当前开源权重领域的先进模型媲美 3. nomic-embed-text-v2 • 多语言 MoE(混合专家)文本嵌入模型 • 出色的多语言检索能力 1. 嵌入接口优化 • 改进了 /api/embed与/v1/embeddings在使用时的截断逻辑2. 架构扩展 • 在 Gemma 3 架构基础上扩展,支持 rnj-1 模型 3. 模型输入修复 • 修复了使用 qwen2.5vl 进行图像输入时出现的报错问题 • 截断逻辑优化:修正运行时截断逻辑,并移除服务器端截断 • rope 重构:提升模型在长上下文处理中的性能稳定性 • rnj-1 推理支持:新增对 rnj-1 模型的推理支持 • qwen2.5vl metal argsort 修复 • nomic-embed-text-v2 模型实现完善 • UI优化: • 修复模型下载完成后能力不更新的问题 • 使用 Ollama 接口进行用户认证与健康检查 • 使用 requestAnimationFrame 防止文本底部被截断 • 性能提升:升级 llama.cpp(17f7f4)版本,提升 SSM 性能 • 命令行工具修复: • 修正 cmd/bench 下 README 中的选项表与二进制文件名 • 路由优化:在工具调用中增加 logprobs 输出 • 模型调整:更新 ministral 与 devstral 的转换与超参数设置 • 模板功能增强:新增 yesterdayDate 辅助函数 • 嵌入性能优化:调整 embeddings 的批量大小 • API扩展:新增 v1/responses 接口支持 • rotary embeddings 修复:解决 ministral 3 在旋转嵌入上的问题 • 文档更新:调整 README 内容
