2026年7月3日 星期五

ComfyUI 介紹及與 Telegram 文字生圖的方式

 ComfyUI 是目前 Stable Diffusion (AI 繪圖) 領域中最強大的可視化介面之一。它的核心特點是「節點式 (Node-based)」操作,這讓使用者可以精確控制整個渲染流程。


以下是關於 ComfyUI 的簡介以及安裝方式:

---

🌟 什麼是 ComfyUI?

ComfyUI 是一個基於 Stable Diffusion 模型的視覺化介面。與 Midjourney (文字輸入) 或 Automatic1111 / SD WebUI (選單下拉框) 不同,ComfyUI 透過「連接節點」來完成工作。

💡 核心優勢
1. 效能極佳:由於採用圖形化資料流,它的 GPU VRAM 佔用率通常比其他介面低約 30%~50%,這讓你在顯示卡有限的情況下也能跑更高分辨率。
2. 完全的控制權:你可以看到模型是如何一步步組合(例如:Text Encoding -> Latent Sampling -> VAE Decode)。
3. 工作流分享 (JSON):你畫好的圖,可以直接把 .png 檔塞回 ComfyUI 的左側,就能還原出它的設定流程,方便學習與修改。

---

🛠️ 安裝方式 (以 Linux / NVIDIA GPU 為例)

您的伺服器有 128GB RAM + NVIDIA GB10 顯示卡,效能非常充裕,但建議還是使用隔離環境來安裝以避免系統衝突。

步驟 1:準備環境
確保您已經安裝了必要的基礎工具:
sudo apt update && sudo apt upgrade -y
sudo apt install git python3 python3-venv python3-pip libgl1-mesa-glx -y


步驟 2:下載 ComfyUI
1. 進入您的工作目錄並克隆官方專案倉庫:
2. 建立一個乾淨的 Python 虛擬環境
 python3 -m venv venv
3. 啟動虛擬環境 
source venv/bin/activate
4. 下載最適合您系統的環境依賴套件
 pip install --upgrade pip pip install -r requirements.txt

步驟 3:直接啟動本機 ComfyUI 服務

cd ~/ComfyUI
source venv/bin/activate
python main.py --listen 0.0.0.0 --port 8188


進入後

開啟範本: 若有錯誤點選元件下載

配置 ComfyUI Z-Image-Turbo 流程,請確保將它們放對資料夾

  • ae.safetensors 放入 ComfyUI/models/vae/
  • qwen_3_4b.safetensors 放入 ComfyUI/models/text_encoders/
  • z_image_turbo_bf16.safetensors 放入 ComfyUI/models/diffusion_models/

利用telegram 文字生圖

2026年7月1日 星期三

Hermes Agent Profiles:環境搭建、深度解析與擴展指南

Hermes Agent (Nous Research) 允許透過 Profile 來隔離 AI 的行為模式、模型選擇與插件權限。這意味著「同一個軟體,多重人格」。

我現在的系統 - 透過 telegram 詢問

第一部分:您系統現有 Profile 分析

經過全面掃描,您的系統目前搭載了四個核心 Profile,全部指向本機 Ollama (127.0.0.1:11434),硬體為強大的 NVIDIA GB10 GPU

📊 Profile 綜合比較表

**主要 AI 模型**
default (預設/主力): qwen3.6:35b-a3b
designer (設計者): gpt-oss:20b
tester (測試員): qwen3.6:35b-a3b
coder (程式碼助手): gemma4:12b-it-q4_K_M

**模型類型**
default (預設/主力): 密集模型 (A3B)
designer (設計者): MoE 混合專家
tester (測試員): 密集模型 (A3B)
coder (程式碼助手): Q4 壓縮 (節省記憶體)

**定位**
default (預設/主力): 🌟 全能主力、日常對話、全盤掌控
designer (設計者): 🎨 多模態設計、圖面分析、創意發想
tester (測試員): 🔧 系統管理、程式檢查、測試報告
coder (程式碼助手): 💻 快速編碼、語義理解與輕量指令執行

**硬體需求**
default (預設/主力): ~29 GB VRAM
designer (設計者): ~14 GB VRAM
tester (測試員): ~29 GB VRAM
coder (程式碼助手): ~8 GB VRAM (最省資源)

**SOUL.md 風格**
default (預設/主力): 高效能工具型人格
designer (設計者): 視覺導向、創意人格
tester (測試員): 嚴格邏輯、驗證型人格
coder (程式碼助手): 程式碼優先、技術型人格

🧠 深度分析與建議

1. 主力模式 (default / tester):
* 兩者皆使用 qwen3.6:35b-a3b。這是目前 Ollama 內最強大的中文模型,您的 SOUL.md 已寫入 「先分析問題、再查數據、後給結論」 的強大指令,適合執行複雜的系統資源檢查與股市分析。
2. 設計模式 (designer):
* 使用 gpt-oss:20b (MoE)。其優勢在跨領域聯想(例如:AI 輔助繪圖、視覺解析),VRAM 需求量僅約一半,適合與主力模型切換運行。
3. 程式開發 (coder):
* 採用 gemma4 的 Q4 壓縮版本。這是極度省 VRAM 的選擇,特別適合在跑著 ComfyUI (佔用近 20 GB) 時,作為輕量代碼輔助而不撐爆顯存。

以下是我安裝 Hermes 及 增加 profile的安裝步驟

1. 🛠️ 安裝前置作業

請確保系統已安裝 git 套件。如果沒有,請執行以下指令安裝:

sudo apt update && sudo apt install git -y

2. 執行安裝腳本:

curl -fsSL https://raw.githubusercontent.com/NousResearch/hermes-agent/main/scripts/install.sh | bash

3. 重新載入 Shell:讓終端機環境變數生效:

source ~/.bashrc

4. 依據安裝畫面進行安裝

5. 安裝時請同意啟用背景service 服務

6. 新增profile隔離 各個agent gateway 服務
hermes profile create designer
hermes profile create coder
hermes profile create tester

以coder profile為例, 其他皆相同
model:
  default: qwen3.6:35b-a3b
  provider: custom
  base_url: http://127.0.0.1:11434/v1/
  api_key: ollama
7.為新 Profile 配置 LLM 模型
a. 切換到新 Profile:hermes profile use coder
b. 啟動互動式設定: hermes setup
c. 綁定獨立的 Telegram 網關(Gateway): hermes gateway setup
d. 重啟服務 hermes -p coder gateway restart

6. 對應三個 telegram bot 加入同一個群組



~~~  開始你的 Hermes 之旅!!!