群发资讯网

张南用科技的文章

把 35kb 的大提示词搬进本地自托管:上下文只有 65k,一进去就吃掉 14%

把 35kb 的大提示词搬进本地自托管:上下文只有 65k,一进去就吃掉 14%

把 35kb 的大提示词搬进本地自托管:上下文只有 65k,一进去就吃掉 14%
同一个模型换个主机就掉 20 分:一个跑了 1800 万条消息的运营者把网关的坑

同一个模型换个主机就掉 20 分:一个跑了 1800 万条消息的运营者把网关的坑

同一个模型换个主机就掉 20 分:一个跑了 1800 万条消息的运营者把网关的坑
你的 AI 编码对话其实全是本地明文:一个小工具 3 天 499 星,把 10

你的 AI 编码对话其实全是本地明文:一个小工具 3 天 499 星,把 10

你的 AI 编码对话其实全是本地明文:一个小工具 3 天 499 星,把 10
20 局象棋里 18 局去连对手引擎:一个开源蜜罐把 GPT-6 Astra 的

20 局象棋里 18 局去连对手引擎:一个开源蜜罐把 GPT-6 Astra 的

20 局象棋里 18 局去连对手引擎:一个开源蜜罐把 GPT-6 Astra 的
自己搭 AI 网关嫌 LiteLLM 太重?

  自己搭 AI 网关的团队大多

自己搭 AI 网关嫌 LiteLLM 太重? 自己搭 AI 网关的团队大多

自己搭 AI 网关嫌 LiteLLM 太重? 自己搭 AI 网关的团队大多
Mac 本地跑大模型别指望 NPU:M1 的 ANE 被逆向了个遍,内存读带宽只

Mac 本地跑大模型别指望 NPU:M1 的 ANE 被逆向了个遍,内存读带宽只

Mac 本地跑大模型别指望 NPU:M1 的 ANE 被逆向了个遍,内存读带宽只
2000 多个包、500 多个被清掉:RubyGems 五月那次攻击,报告说是

2000 多个包、500 多个被清掉:RubyGems 五月那次攻击,报告说是

2000 多个包、500 多个被清掉:RubyGems 五月那次攻击,报告说是

刚接触写作那会总觉得是一个人摸黑走夜路,对着空白文档坐三小时,脑子里翻涌的千头万

刚接触写作那会总觉得是一个人摸黑走夜路,对着空白文档坐三小时,脑子里翻涌的千头万
省钱插件报"省 89% token",实测账单没降:RTK 跑了 1740 次基

省钱插件报"省 89% token",实测账单没降:RTK 跑了 1740 次基

省钱插件报"省 89% token",实测账单没降:RTK 跑了 1740 次基
DeepSeek 又开源一个 763B 模型:每个 token 只激活 16B、

DeepSeek 又开源一个 763B 模型:每个 token 只激活 16B、

DeepSeek 又开源一个 763B 模型:每个 token 只激活 16B、
本地跑大模型,先别急着下模型:3.6 万星 llmfit 一条命令扫完硬件,告诉

本地跑大模型,先别急着下模型:3.6 万星 llmfit 一条命令扫完硬件,告诉

本地跑大模型,先别急着下模型:3.6 万星 llmfit 一条命令扫完硬件,告诉
编程 Agent 的模型账单能省多少?

  9 月 10 日,做 Devin

编程 Agent 的模型账单能省多少? 9 月 10 日,做 Devin

编程 Agent 的模型账单能省多少? 9 月 10 日,做 Devin
给 Claude Code 全权限又怕它拆机器?

  跑 Claude Cod

给 Claude Code 全权限又怕它拆机器? 跑 Claude Cod

给 Claude Code 全权限又怕它拆机器? 跑 Claude Cod
10 分钟录音 2 秒转完:欧洲实验室一次放出 18 个端侧模型,但评论区认出

10 分钟录音 2 秒转完:欧洲实验室一次放出 18 个端侧模型,但评论区认出

10 分钟录音 2 秒转完:欧洲实验室一次放出 18 个端侧模型,但评论区认出

纳维-斯托克斯被 AI 证出来了? 9 月 8 日,OpenAI 公布自家内部模

纳维-斯托克斯被 AI 证出来了? 9 月 8 日,OpenAI 公布自家内部模
mlx-serve:819 星把 Mac 变成本地 AI 服务器,无需联网运行

mlx-serve:819 星把 Mac 变成本地 AI 服务器,无需联网运行

mlx-serve:819 星把 Mac 变成本地 AI 服务器,无需联网运行
API 越用越贵?扩散模型 Mercury 2.5 上线:1107 token/

API 越用越贵?扩散模型 Mercury 2.5 上线:1107 token/

API 越用越贵?扩散模型 Mercury 2.5 上线:1107 token/
2.8 万亿参数的 Kimi K3 在 128GB MacBook Pro 上跑

2.8 万亿参数的 Kimi K3 在 128GB MacBook Pro 上跑

2.8 万亿参数的 Kimi K3 在 128GB MacBook Pro 上跑
2.8 万亿参数的 Kimi K3 在 128GB MacBook Pro 上跑通了:每秒 1 个 token,512
一台上限 128GB 内存的 MacBook Pro,跑起了 2.8 万亿参数(约 1.45TB 专家权重)的完整版 Kimi K3——2026 年 9 月 8 日开源项目 del

2.8 万亿参数的 Kimi K3 在 128GB MacBook Pro 上跑通了:每秒 1 个 token,512 一台上限 128GB 内存的 MacBook Pro,跑起了 2.8 万亿参数(约 1.45TB 专家权重)的完整版 Kimi K3——2026 年 9 月 8 日开源项目 del

2.8 万亿参数的 Kimi K3 在 128GB MacBook Pro 上跑通了:每秒 1 个 token,512 一台上限 128GB 内存的 MacBook Pro,跑起了 2.8 万亿参数(约 1.45TB 专家权重)的完整版 Kimi K3——2026 年 9 月 8 日开源项目 del
给 7 个 AI 各 300 美元和一台电脑去赚钱:乱开 1.2 万美元发票、群

给 7 个 AI 各 300 美元和一台电脑去赚钱:乱开 1.2 万美元发票、群

给 7 个 AI 各 300 美元和一台电脑去赚钱:乱开 1.2 万美元发票、群