AI 网摘

应用技巧 · 行业趋势

日刊 标签 搜索 RSS

#LLM

9 篇 · 全部标签

Qwen3.8-Flash-Next:125B MoE 只激活 6B,Simon 在 DGX Spark 上跑通量化版

2026年8月26日 · Simon Willison · 日刊 2026-08-27 · 来源

阿里开源多模态 MoE 预览 Qwen4 架构;Simon 用 Unsloth 1–2 bit 量化在 DGX Spark 本机推理,教你选量化档、关过度思考、何时值得上这台「大参数小激活」模型。

  • #应用技巧
  • #LLM
  • #开源模型

llm-anthropic 0.27:跟进 Anthropic SDK 1.0 与 httpx2 迁移

2026年8月24日 · Simon Willison · 日刊 2026-08-25 · 来源

Simon Willison 发布 LLM 的 Anthropic 插件 0.27,适配 anthropic Python SDK 1.0(httpx→httpx2);他用 Claude Code 读官方迁移指南自动提 PR。

  • #应用技巧
  • #Python
  • #CLI
  • #LLM
  • #Anthropic

llm 0.32.1:新装用户因 httpx 依赖断裂而装不上

2026年8月21日 · Simon Willison · 日刊 2026-08-22 · 来源

Simon Willison 的 LLM CLI 因 OpenAI SDK 移除 httpx 导致全新 pip install 失败。0.32.1 临时 pin openai<3,0.33 将迁到 httpx2。

  • #应用技巧
  • #Python
  • #CLI
  • #LLM

Qwen 3.8 27B 对标千亿级模型:Artificial Analysis 指数 52 分

2026年8月17日 · Simon Willison · 日刊 2026-08-18 · 来源

Simon Willison 援引榜单:27B 开源模型与 GPT-5.6 Luna (max) 同分,仅落后 GLM-5.2、DeepSeek V4 Pro 一分——教你如何用第三方指数筛模型、何时值得本机跑小模型。

  • #应用技巧
  • #LLM
  • #开源模型

Muse Glimmer:Meta 30B 开源权重,面向本地 Agent 与工具调用

2026年8月10日 · Simon Willison · 日刊 2026-08-11 · 来源

Meta 以 Apache 2.0 放出 30B 的 Muse Glimmer,主打 Agent 全流程、工具调用与多步推理;32GB 内存可跑,还带视觉能力。教你用 LM Studio 与 llm 插件本地试跑。

  • #应用技巧
  • #LLM
  • #Agents

condense-json 1.0:用替换表压缩重复 JSON 子串

2026年8月2日 · Simon Willison · 日刊 2026-08-03 · 来源

Simon Willison 的 Python 小库:把 JSON 里反复出现的子串抽成替换表,用 $r 语法引用,可逆压缩 LLM 日志等重复结构。

  • #应用技巧
  • #Python
  • #JSON
  • #LLM

DeepSeek V4 Flash:高性价比 Agent 模型与 reasoning 档位实测

2026年7月31日 · Simon Willison · 日刊 2026-08-01 · 来源

Simon Willison 实测 DeepSeek V4 Flash 0731:Artificial Analysis 性价比榜首,OpenRouter 上默认推理画不好鹈鹕,调高 reasoning_effort 才靠谱。

  • #应用技巧
  • #LLM
  • #DeepSeek

Kimi K3 开放权重:1.56TB 与更严的商用许可

2026年7月27日 · Simon Willison · 日刊 2026-07-28 · 来源

Moonshot 如约放出 Kimi K3 权重;许可从「改 MIT」收紧到 MaaS 大厂需单独签约。教你区分 open weight 与 open source,以及如何用 OpenRouter 按量接入。

  • #应用技巧
  • #LLM

Kimi K3 拒泄系统提示词:一句反问背后的工程信号

2026年7月17日 · Simon Willison · 日刊 2026-07-18 · 来源

Simon Willison 用 token 计数推断 Kimi K3 藏了约 85 token 系统提示词;模型拒泄后反问「今天我能帮你什么?」—— 教你如何用低成本探针摸清新模型行为。

  • #应用技巧
  • #LLM