28
8月
重点·来源 · github.com·2026/08/28
llama.cpp 新增 Nemotron3.5 DSpark 支持
llama.cpp项目在其最新版本中集成了对Nemotron3.5模型DSpark功能的支持。
28
8月
重点·来源 · github.com·2026/08/28
Ollama v0.33.2-rc1 发布,修复与改进多项功能
Ollama发布了v0.33.2-rc1版本,其中包含系统暗模式恢复、模型目录变化时代理请求的连续性以及macOS应用切换同步等多项改进。
28
8月
重点·来源 · github.com·2026/08/28
vLLM v0.28.0 发布,重点优化Kimi-K3性能
vLLM发布了0.28.0版本,此版本包含584次提交,并着重对Kimi-K3模型进行了重大性能优化,包括增加了解码上下文并行(DCP)支持。
28
8月
重点·来源 · github.com·2026/08/28
Claude Code v2.1.247 发布,新增反馈工具
Claude Code v2.1.247版本新增了一个“SendFeedback”工具,允许Claude在会话出错时为用户起草反馈报告。
28
8月
重点·来源 · blog.google·2026/08/28
Gemini-3.5-Transcribe 发布,聚焦转录任务
Google推出了Gemini-3.5-Transcribe,这是一款专为转录任务优化的新型Gemini模型。
28
8月
重点·来源 · x.com·2026/08/28
DeepSeek-V4-Pro API 75折限时优惠,并支持1M上下文
DeepSeek-V4-Pro API推出75折优惠活动直至2026年5月,并更新了集成方式,允许用户解锁1M上下文。
28
8月
重点·来源 · x.com·2026/08/28
Arena.ai报告:Kimi K3在AI代理成本效益方面表现突出
Arena.ai的分析显示,在AI代理任务中,Kimi K3 (Max)以0.62美元的中位任务成本,在效率和价格上优于Claude Opus等模型。
28
8月
重点·来源 · x.com·2026/08/28
Arena.ai推出Agent Arena帕累托前沿分析,展示模型性能与成本平衡
Arena.ai在Agent Arena中引入帕累托前沿分析,以评估模型在实际代理任务中的性能与中位成本权衡,目前Claude Opus、Gemini-Flash和Qwen-Max处于帕累托前沿。