群发资讯网

现在只差一个 harness 使用 Fable 或者 GPT6 来编排这些本地代理了,然后你可以省下一大笔 token 开销。毕竟单台 Spark 已经可以跑 1M 上下文的 125b 的 qwen3.8-flash 了 甚至可以联合多台 Spark 跑 Qwen3.8max 当然 m5ultra MacStudio 也是个选项 #小红书科技AMA #科技数码howto #电驱动系统 #大模型

现在只差一个 harness 使用 Fable 或者 GPT6 来编排这些本地代理了,然后你可以省下一大笔 token 开销。毕竟单台 Spark 已经可以跑 1M 上下文的 125b 的 qwen3.8-flash 了 甚至可以联合多台 Spark 跑 Qwen3.8max 当然 m5ultra MacStudio 也是个选项
#小红书科技AMA #科技数码howto #电驱动系统 #大模型