28
8月
重点·来源 · x.com·2026/08/28
阿里云Qwen3.8-Flash 125B MoE模型实现75GB内存本地运行,性能超越Claude-Opus
阿里云的Qwen3.8-Flash 125B MoE模型借助Unsloth AI的支持,现已能在仅75GB内存下本地运行,并且性能超越了Claude-Opus-4.6 (Max)。
28
8月
重点·来源 · x.com·2026/08/28
GLM-5.3-Flash 可通过Unsloth GGUF在128GB内存本地运行,性能媲美Claude Opus
借助Unsloth GGUF,GLM-5.3-Flash (ox-alpha)模型现在可以在128GB内存下进行3比特本地运行,其在多个基准测试中表现可与Claude Opus 4.8媲美。
28
8月
重点·来源 · x.com·2026/08/28
Grok Bot推出早期测试版,AI队友实现自动化工作
Grok Bot已进入早期测试阶段,作为AI队友,它能登录用户工具并像人类一样完成实际工作。
28
8月
重点·来源 · x.com·2026/08/28
Kimi K3开源模型正式上线并集成至GitHub Copilot
Kimi_Moonshot的开源模型Kimi K3已正式发布并开始集成到GitHub Copilot中,该模型以其在代理式编码方面的前沿能力和高性价比著称。
28
8月
重点·来源 · developers.google.com·2026/08/28
Gemini Code Assist多项更新:2.5 Pro/Flash GA,代理模式预览与AI文件排除
Gemini Code Assist推出多项更新,包括Gemini 2.5 Pro和2.5 Flash模型正式可用,VS Code内测版新增代理模式预览,以及支持配置AI排除文件。
27
8月
重点·来源 · github.com·2026/08/27
llama.cpp 发布 b10648 版本,简化 MiniMax-01 图结构
llama.cpp 项目发布了 b10648 版本,主要更新是简化了 MiniMax-01 模型的图结构。
27
8月
重点·来源 · github.com·2026/08/27
Ollama 发布 v0.33.1:支持 MLX Qwen3.8 Flash Next,优化 Metal GPU 性能
Ollama v0.33.1 版本已发布,新增对 MLX Qwen3.8 Flash Next 的支持,并解决了加载模型时 Metal GPU 超时等问题。
27
8月
重点·来源 · github.com·2026/08/27
Claude Code v2.1.247 发布:新增自动反馈工具
Claude Code v2.1.247 版本新增了 SendFeedback 工具,允许 Claude 在会话中自动起草反馈报告供用户审查和发送。