福大大架构师每日一题
06-28·AI领域创作者
AI创作者AMA知无不言
ollama v0.30.11发布:Thinking能力检测、Claude Code与OpenCode自动安装、Windows Vulkan修复、MLX推测解码大升级全解析根据发布说明,ollama v0.30.11 包含以下更新内容:• launch:为 opencode 增加 thinking capability detection• launch:自动安装 Claude Code• launch:当缺失时自动安装 opencode• discover:修复 Windows 混合显卡环境下 iGPU 与 dGPU 的 Vulkan 分类颠倒问题• mlxrunner:统一并调优 speculative decoding• launch/codex:当 Codex App UI 发生切换时检测 model drift• llama:为 cuda_v13_windows preset 增加 sm_86 架构• llm:按照 projector memory 来确定 mmproj offload 大小• docs:补充 max think level 文档• llm:为 shifted prompts 保留 generation headroom• llama:默认设置 qwen2.5vl window attention metadata• llm:在 Windows 上使用 host Vulkan loader• mlx:更新并修复 CUDA JIT packaging• llm:修复 ollama ps 在 partial offload 场景下对 mmap 权重重复统计的问题• docs:重新设计 docs landing 和 integrations overview• server:让 generate 与 native chat templates 对齐• jetson:为 CUDA v13 增加 CC 87• llama.cpp version update
发布于 北京
1
评论
1
未登录
友善发言
image-upload
评论
加载中