27
8月
重点·来源 · x.com·2026/08/27
Agent Arena 报告:Kimi K3 在 AI 任务成本效益上超越 Claude Opus
Arena.ai 的分析显示,在 Agent Arena 排名前列的 AI 模型中,Kimi K3 (Max) 的任务中位成本为 $0.62,远低于 Claude Opus 的 $3.37,显示出更高的成本效益。
27
8月
趋势·来源 · developers.google.com·2026/08/27
Gemini Code Assist 更新:Gemini 2.5 Pro 和 Flash 模型正式可用
Gemini Code Assist 已正式支持 Gemini 2.5 Pro 和 Gemini 2.5 Flash 模型,这些模型现已向所有用户层级开放。
27
8月
趋势·来源 · arxiv.org·2026/08/27
arXiv 发布 GreenLeaf Law Embed Tiny:法律领域紧凑型嵌入模型
arXiv 上发布了 GreenLeaf Law Embed Tiny,这是一个用于法律领域检索的 0.6B 参数紧凑型嵌入模型,在大型法律嵌入基准测试中达到了 75.11% 的准确率。
27
8月
趋势·来源 · www.mturk.com·2026/08/27
Amazon Mechanical Turk 宣布将于 9 月 30 日关闭
亚马逊的众包平台 Mechanical Turk 宣布将于 9 月 30 日停止运营。
27
8月
趋势·来源 · www.reddit.com·2026/08/27
Reddit 讨论:Qwen3.8-Flash-Next 表现优于 DeepSeek V4 Pro
r/LocalLLaMA 上的讨论表明,Qwen3.8-Flash-Next 在性能上可能超越 DeepSeek V4 Pro。
27
8月
重点·来源 · github.com·2026/08/27
llama.cpp 发布 b10642 版本,新增 token ID 追踪功能
llama.cpp 发布 b10642 版本,核心改进是为 KV 单元增加了 token ID 追踪功能。
27
8月
重点·来源 · github.com·2026/08/27
vLLM v0.28.0 发布,重点优化 Kimi-K3 性能
vLLM 发布 v0.28.0 版本,包含 584 次提交,其中一项主要优化是针对 Kimi-K3 模型的性能提升,并支持解码上下文并行 (DCP)。
27
8月
重点·来源 · github.com·2026/08/27
Claude Code v2.1.247 更新,新增 SendFeedback 工具
Anthropic 的 Claude Code 发布 v2.1.247 版本,新增加了一个 SendFeedback 工具,允许用户在会话出错时起草反馈报告。