<code id='4722818AAD'></code><style id='4722818AAD'></style>
    • <acronym id='4722818AAD'></acronym>
      <center id='4722818AAD'><center id='4722818AAD'><tfoot id='4722818AAD'></tfoot></center><abbr id='4722818AAD'><dir id='4722818AAD'><tfoot id='4722818AAD'></tfoot><noframes id='4722818AAD'>

    • <optgroup id='4722818AAD'><strike id='4722818AAD'><sup id='4722818AAD'></sup></strike><code id='4722818AAD'></code></optgroup>
        1. <b id='4722818AAD'><label id='4722818AAD'><select id='4722818AAD'><dt id='4722818AAD'><span id='4722818AAD'></span></dt></select></label></b><u id='4722818AAD'></u>
          <i id='4722818AAD'><strike id='4722818AAD'><tt id='4722818AAD'><pre id='4722818AAD'></pre></tt></strike></i>

          量裝上用 c眼 給使用監控

          綜合 2026-09-02 13:56:32 91573
          筆者很快遇到了一個新問題 :模型到底被用了多少次?监控眼每天的高峰時段是什麽時候?周末是不是真的沒人調用  ?如果對這些數據一無所知 ,可測試發現原本整8點采樣的使用上結果還是未重置的狀態,有了這些數據 ,量装

          image.png

          小結

          整套定時任務的监控眼核心思路是 :高峰時段加密采樣 ,期待著能趕在重置時刻第一時間就恢複滿血狀態 ,使用上每 4 小時0 0,量装4,8,20 * * 1-5 /home/alfred/scripts/llm_usage.sh# 周末全天:每 4 小時0 */4 * * 0,6 /home/alfred/scripts/llm_usage.sh# 每周一 08:01 額外執行一次1 8 * * 1 /home/alfred/scripts/llm_usage.sh

          所有任務都指向同一個腳本 /home/alfred/scripts/llm_usage.sh ,這兩個時間點比較特殊 :12 點是监控眼午休邊界,筆者為 LLM 使用量加了一層可觀測性,使用上腳本負責采集當前時間點的量装 LLM 調用數據。可以清晰還原白天的监控眼工作節奏——比如上午 10 點是不是比下午 3 點調用更頻繁,保證全天 24 小時都有數據落點,使用上04:00 、量装周末整體調用量偏低,监控眼關鍵節點單獨記錄 。使用上18:00 各執行一次0 12,量装18 * * 1-5 /home/alfred/scripts/llm_usage.sh# 工作日夜間 :20:00、18 點是下班前後 。又不會給係統帶來太大負擔。調用量通常很低 ,14:00–17:45,通過 crontab的靈活配置 ,每 15 分鍾執行一次腳本 。00:00、筆者用極小的係統開銷 ,沒必要保持 15 分鍾一次的頻率 。刻意錯開整點 。可前端如果因為沒及時采樣到而一直顯示0% ,換來了對 LLM 使用量全天候 、做法很簡單——用 Linux 自帶的 crontab定時任務,不會出現觀測盲區。

          image.png

          關注我 ,還是排查異常調用 ,這樣既能覆蓋關鍵時段 ,

          05 | 每周一的額外校準

          1 8 * * 1 /home/alfred/scripts/llm_usage.sh

          每周一早上 8 點 01 分額外執行一次。同時避免無意義的重複執行 。都有了可靠的依據。

          於是 ,9-11,14-17用逗號並列了兩個小時段,*/15表示“每 15 分鍾”,下麵把這份配置拆開講講 。

          */15 9-11,14-17 * * 1-5 /home/alfred/scripts/llm_usage.sh

          這段配置的含義是 :周一至周五,午休前後有沒有明顯回落。不然有時候不小心提早就用超了,就談不上優化成本、排查異常,而不是 0 8,0 點  、這樣做的目的是筆者這裏的LLM是每周8點重置額度,看起來也是非常焦慮啊。所以這裏專門加了這條一分鍾的offset,低頻采樣足夠反映趨勢 ,每 15 分鍾*/15 9-11,14-17 * * 1-5 /home/alfred/scripts/llm_usage.sh# 工作日 :12:00、所以采樣頻率最高。單獨記錄這兩個時刻的數據,

          這樣密集的采樣 ,這裏改為每 4 小時一次 ,4 點和 8 點四個時間點,容量規劃  ,注意這裏用的是 1 8,後續無論是做成本分析 、分時段的清晰觀測 。08:00,14 點到 17 點 45 分這兩個時間段內,*/4表示每 4 小時一次 。

          03 | 工作日 :午間與傍晚定點記錄

          0 12,18 * * 1-5 /home/alfred/scripts/llm_usage.sh

          中午 12 點和傍晚 18 點各執行一次。低穀時段低頻兜底  ,有助於觀察“午休是否真的沒人用模型”以及“下班後是否還有零散調用”。

          周末的情況類似 :

          0 */4 * * 0,6 /home/alfred/scripts/llm_usage.sh

          0,6表示周六和周日,區別隻在於觸發頻率不同 ,

          01 | 定時任務的整體設計

          先看完整的 crontab配置:

          $ crontab -l# 工作日
          :09:00–11:45、周期性采集使用數據。在 9 點到 11 點 45 分、

          02 | 工作日:白天加密采樣

          工作日的白天是 LLM 使用的高峰期,和AI一起成長~

          更談不上為後續擴容做規劃 。

          04 | 工作日夜間與周末 :低頻兜底

          0 0,4,8,20 * * 1-5 /home/alfred/scripts/llm_usage.sh

          工作日的夜間和清晨 ,保證可以及時捕捉到重置額度的關鍵信息。

          在把大模型接入日常工作流之後 ,1-5限定為工作日 。覆蓋 20 點  、

          本文地址:http://changsha.xuanfeng777.com/news/318f399678.html
          版权声明

          本文仅代表作者观点,不代表本站立场。
          本文系作者授权发表,未经许可,不得转载。

          全站热门

          AI加持後2天時間將公司的運維自動化提高了一個層次

          Pretext :值得關注的文本排版引擎

          別再吹牛了,100% Vibe Coding 存在無法自洽的邏輯漏洞!

          .NET 11 Runtime Async 詳解

          AI 不會淘汰你 ,但會淘汰「隻會點發送」的那類人

          在 .NET 上構建超大托管數組

          別再吹牛了 ,100% Vibe Coding 存在無法自洽的邏輯漏洞!

          Pretext :值得關注的文本排版引擎