HERMES OPERATIONS REVIEW · HERMES REPORT

주간 Hermes Dreaming 리포트

🌙 Weekly Hermes Dreaming Report

원본 Markdown ↗
GENERATED
2026-08-23 03:34 대한민국 표준시
REPORT ID
weekly-hermes-dreaming
LENGTH
한글 3,667자 · 2,102 words
CHECKSUM
964499aec3c9

🌙 Weekly Hermes Dreaming Report

기준 기간: 2026-08-16 ~ 2026-08-23 운영 모드: 제안 모드 — 이번 실행에서는 memory.remove/replace, skill_manage patch/delete, cron 수정 같은 실제 변경을 수행하지 않았습니다.

1. 이번 주 관찰 요약

  • 최근 7일 사용량: hermes insights --days 7 기준 세션 324개, 메시지 17,962개, 툴 호출 11,929회, 총 토큰 지표 542,845,526.
  • 플랫폼 분포: cron 251세션 / 392.7M 토큰, subagent 59세션 / 33.6M 토큰, Discord 14세션 / 116.5M 토큰. 즉, 이번 주 운영 부하는 Son님의 직접 대화보다 cron/자동화가 압도적으로 큼.
  • 모델 분포: gpt-5.6-sol 118세션 / 384.98M, gpt-5.5 132세션 / 96.18M, gpt-5.6-terra 74세션 / 61.68M. Son님 방침상 당분간 기본 모델은 GPT-5.5 유지가 맞지만, 실제 고비용 구간은 gpt-5.6 계열 cron/Discord 작업에서 발생 중입니다.
  • 툴 사용: read_file 3,317회, web_search 2,334회, terminal 2,183회, search_files 1,258회, patch 723회, write_file 706회. 파일·웹·터미널 기반의 실제 실행/검증 작업이 많았고, 단순 대화형 사용은 적었습니다.
  • 상위 스킬: research-reporting-workflows 177회, web-design-reference-ops 25회, d-survivor-context 13회, steam-market-research 11회, godot-game-development 10회, web-interactive-app-systems 9회. 리서치/웹디자인/게임/배포가 주 운영축입니다.
  • Cron 상태: 활성·정지 작업이 혼재합니다. 주요 활성군은 경제/AI 브리핑, AI 기술담론, Weekly Dreaming, cron health, d-survivor readonly updater, 음악·게임산업·hype wiki study, web-design scout/deep 연구, benefit/AI opportunity radar 등입니다. LifeOS·SQAF·일부 게임/웹뷰 감사 작업은 paused 상태입니다.
  • Curator 상태: curator는 enabled, agent-created skills 94개 중 active 51개, stale 43개. hermes curator run --dry-run 결과는 no changes; consolidation off였습니다. 즉 자동 archive/delete는 없었고, 현재는 deterministic stale/archive 후보를 보고만 하는 상태입니다.

2. 반복 패턴

성공 패턴

  1. 실제 실행 후 검증하는 작업 방식이 정착 중
  2. 이번 주 Discord 직접 세션 중 운동 루틴 웹앱, 후지 록/음악 다큐 웹, GitHub/Cloudflare 배포, 3D 뷰어, 아재개그 퀴즈 사이트 등은 “구현 → 빌드/배포 → 브라우저 QA → 모바일 390px 확인 → 콘솔/overflow 검증” 흐름을 반복했습니다. 품질 우선 방침과 잘 맞습니다.

  1. 사용자 교정이 skill/reference로 흡수되는 경향
  2. 예: YouTube 플레이어 16:9 collapse 문제는 music-artist-documentary-web에 패치된 적이 있고, Windows cron wrapper false-green 문제는 hermes-recurring-automation에 반영되었습니다. 실패가 절차 지식으로 바뀌는 점은 좋습니다.

  1. 웹디자인 연구 자동화가 과잉에서 경량/심층 분리로 안정화됨
  2. 초기에는 하루 16회급 고정밀 심층 조사로 토큰을 크게 태웠지만, 이후 web-design-reference-research-worker를 만들고 오전 scout / 저녁 deep으로 분리했습니다. 이는 이번 주 가장 중요한 비용·품질 균형 개선입니다.

  1. Discord 중심 운영 규칙이 비교적 잘 지켜짐
  2. 긴 보고서는 HTML 웹뷰, 상태성 요약은 Discord 채널/스레드, 직접 대화는 Son님의 실시간 요구에 맞춰 처리되는 패턴이 유지되고 있습니다.

  1. 전문성 경계 인식이 개선됨
  2. MiniMax H3, Steam 사업자, 운동 루틴, 후지 록 웹디자인 등에서 출처 기반/전문 기준을 확인하고, 과장된 결론을 피하려는 흐름이 보입니다.

실패/마찰 패턴

  1. 자동화가 너무 무겁게 출발하는 경향
  2. 웹디자인 연구가 대표 사례입니다. 처음부터 모든 레인을 심층 브라우저 QA로 돌려 토큰 화형식에 가까운 비용이 발생했습니다. 이후 경량화했지만, 새 자동화 설계 시 “풀파워 기본값”을 조심해야 합니다.

  1. 임시 QA 프로세스의 잔존/정체성 혼란
  2. Son님이 sonia-toypetme 브라우저 프로세스의 정체를 물은 세션이 있었습니다. QA 임시 프로세스는 검증 후 종료한다는 memory가 이미 있지만, cron/브라우저 작업 증가로 혼동 가능성이 계속 있습니다.

  1. LLM이 비효율 작업 경계를 늦게 판단
  2. 3D 모델 웹 뷰어 세션에서 LLM이 절차적 박스/원통 조립으로 하드서피스 모델을 만들다가 “엄청나게 로우폴리” 피드백을 받았습니다. Son님 교정처럼 LLM의 강점은 3D 모델 자체 제작보다 3D 생성 파이프라인 선택, Blender/GLB/뷰어/배포 자동화입니다.

  1. 배포/cron의 false-green 위험이 반복 주제
  2. 과거 브리핑 .sh wrapper가 gateway PATH에서 실패했는데도 cron이 ok로 기록된 사건, Cloudflare alias propagation과 remote byte mismatch, webview collision-safe temp rule 등은 모두 “성공처럼 보이는 실패” 계열입니다. 이 패턴은 계속 경계해야 합니다.

  1. compaction summary와 장기 memory의 경계가 중요해짐
  2. 긴 세션에서 압축 요약이 대량으로 들어오며, “최신 사용자 메시지 우선 / historical task 자동 재개 금지” 원칙이 반복됩니다. 이는 잘 작동하지만, memory가 임시 진행상황으로 오염되면 위험합니다.

3. Memory 감사

분류항목이유권장 조치
유지Discord-only; #hermes-home→thread..., 장문=HTML현재 Discord 중심 운영 및 이번 웹뷰 전달 방식과 일치합니다.유지
유지셋업=지정 구성 설치·검증만; 추가 런처·자동화 금지. QA 임시 프로세스는 검증 후 종료.이번 주 QA 임시 브라우저 혼란과 직접 연결됩니다. 더 중요해졌습니다.유지, 단 cron/브라우저 작업에도 적용된다는 표현을 다음 승인 시 강화 후보
유지SW/DevOps/SRE 경력; 기술 논의는 엔지니어 수준...Hermes/cron/배포/토큰비용 논의에서 계속 유효합니다.유지
유지로컬 서비스 링크는 Tailscale+localhost 병기 선호.이번 주 웹앱/뷰어 로컬 검증에서 반복 적용됩니다.유지
유지웹게임: ... 공간/상태 QA 후 TDD·실행·독립리뷰.웹게임·인터랙티브 앱 작업이 계속 있으며, 품질 기준으로 유효합니다.유지
수정Hermes+Mac Mini=AI autonomy lab.현재 실행 호스트는 Windows 10이며 Hermes 운영 자산은 C:/Users/msi/AppData/Local/hermes 중심입니다. Mac mini 맥락은 역사적으로 유효할 수 있으나 현재 기본 운영 환경과 충돌 여지가 있습니다.“Hermes AI autonomy lab은 현재 Windows Hermes host 중심이며 일부 legacy Mac mini 맥락이 남아 있음” 식으로 약화/정정 후보
수정Reports: main hermes-reports-dga.pages.dev; J-MUSIC jmusic-power.pages.dev.현재 report renderer가 slug별 웹뷰를 생성·배포하고, 음악/후지/기타 Pages 프로젝트도 많습니다. 단일 “main” 정보는 유효하지만 너무 압축되어 운영자가 오해할 수 있습니다.“main public report hub / special standalone Pages 분리”로 보강 후보
유지Hermes profiles: ops/research/dev/dashboard/quant/game... write only on explicit 지식화.이번 주 위키 study, web-design wiki, hype/music/game-industry wiki 운영과 잘 맞습니다.유지
유지Sonia research wikis: C:/Users/msi/sonia-wikis/{music,game-industry,hype-cases}... write only on explicit 지식화.cron wiki study가 활성이고, fact/inference 분리가 핵심입니다.유지
유지Web design: wiki C:/Users/msi/sonia-wikis/web-design; router web-design-reference-ops...이번 주 web-design 연구 자동화의 중심 memory입니다.유지
신규후보“3D/GLB 요청에서 LLM은 고품질 하드서피스 모델을 코드 조립으로 직접 만들기보다, 3D 생성/Blender/에셋 확보/GLB 최적화/웹뷰어·배포 파이프라인을 맡는 편이 효율적.”Son님이 직접 교정한 반복 가능 선호/운영 원칙입니다. 단기 작업 상태가 아니라 재사용 의사결정 기준입니다.신규 memory 후보 또는 web-interactive-app-systems reference 후보
신규후보“웹디자인 조사위키 기반”은 web-design-reference-ops + C:/Users/msi/sonia-wikis/web-design의 SCHEMA/taxonomy/scorecard/index 및 최신 scout/run을 읽는 의미. 별도 session_search보다 위키 우선.Son님이 직접 “위키화되어있을텐데?”라고 교정했고, 이후 안정된 호출 문구로 정리됐습니다. 현재 memory에도 유사 항목은 있으나 호출 문구까지는 없음.신규 memory 후보 또는 기존 Web design memory 보강 후보
신규후보“Cron/배포 성공은 status=ok만으로 판단하지 않고, artifact 내용·공개 URL·remote byte/hash/read-back까지 확인해야 한다.”false-green이 반복된 운영 리스크입니다. memory보다는 skill 절차가 더 적합하지만, 고수준 원칙은 memory 후보입니다.memory보다는 hermes-recurring-automation/static-report-publishing 유지·강화 권장
삭제후보생일, 아티스트 지역순위 등 현재 Dreaming 범위와 무관한 user memory장기적으로는 유용할 수 있으나 현재 memory가 아직 작아서 삭제 필요는 낮습니다.삭제하지 않음; 공간 부족 시 후순위 압축 후보

4. Skill 감사

스킬/절차관찰권장 조치
research-reporting-workflows최근 7일 177 loads, 전체 usage 누적도 매우 큼. 리서치/보고서 계열의 중심 스킬입니다. patch_count도 높아 비대화 위험이 있습니다.유지. 단 reference가 과도하게 늘면 도메인별 하위 reference 정리/색인 강화 후보
web-design-reference-research-worker고비용 웹디자인 조사 자동화를 경량 scout/deep 구조로 바꾼 핵심 안정화 스킬입니다. 최근 cron에서 활발히 사용 중입니다.유지. 다음 주 실제 토큰 절감 효과를 insights로 재측정
web-design-reference-ops인터랙티브 웹디자인 작업의 router. Son님이 “웹디자인 조사위키 기반”이라는 축약어를 안정적으로 쓰기 시작했습니다.유지. 위키 우선 호출 문구를 skill 상단에 더 명확히 넣는 patch 후보
static-report-publishing이번 weekly webview 전달 및 report renderer 운영에 직접 관련. renderer edge case와 mobile report patterns가 잘 축적되어 있습니다.유지. 보고서 웹뷰 cron job들이 모두 collision-safe temp rule을 지키는지 별도 감사 후보
cloudflare-pages-deploymentPages 배포/검증에서 계속 중요. cross-project env overwrite 및 stable alias propagation 이슈가 이미 reference로 축적되어 있습니다.유지. 잘못된 PROJECT_NAME 환경 오염 guard를 모든 standalone deploy helper에 확산 점검 후보
hermes-recurring-automationcron false-green, Windows bash PATH, script-only cron, no-agent 패턴 등 핵심 운영 지식이 축적되어 있습니다.유지/강화. cron health summary와 watchdog이 실제 artifact 내용을 보는지 다음 주 재감사
visual-asset-qa이미지/영상/웹 시각 QA에서 자주 사용. Son님 품질 우선 운영과 맞습니다.유지. 390px/430px 모바일 CDP 기준과 생성 이미지 출처·오인 방지 기준 계속 유지
web-interactive-app-systems웹앱·인터랙티브 페이지 작업이 많고 최근 3D 뷰어 교정과 연결됩니다.patch 후보: “LLM procedural 3D는 proxy/viewer 검증용, 고품질 모델은 3D 전용 파이프라인” 절차 추가
d-survivor-context최근 13 loads, d-survivor readonly updater도 활성입니다. 단 “explicitly names it” 원칙이 중요합니다.유지. 자동 updater는 no-push/read-only invariant 계속 확인
llm-wiki누적 use 480, wiki study cron에서 매우 활발합니다.유지. 단 wiki write는 “지식화” 명시 요청 시만이라는 memory와 충돌하지 않도록 cron prompt 점검
stale agent-created skillscurator status상 agent-created 94개 중 stale 43개. dry-run은 전환 없음. low/no-use agent-created 후보: spoken-voice-asset-production, integration-adapter-contract-testing, voice-and-tts-production.즉시 delete/patch 금지. 다음 curator 주기에서 사용 여부 확인 후 archive 후보로만 제안
zero-use stale bundled/hub-like skillsairtable, apple-notes, arxiv, ascii-art, claude-code, notion, openhue, powerpoint, teams-meeting-pipeline 등 zero-use stale 다수.삭제보다는 비활성/아카이브 후보. 허브/번들 성격이면 curator가 건드리지 않게 유지 가능

5. Cron/자동화 감사

잘 작동하는 자동화

  • 경제/AI 브리핑 계열: 최근 last run ok, Discord 전달 유지. 과거 wrapper false-green 복구 이후 실제 artifact/웹뷰 검증 패턴이 강화됨.
  • weekly-hermes-dreaming: 현재 실행 중이며 HTML 웹뷰 링크 전달 규칙 적용.
  • cron-health-summary: active, no-agent script로 #periodic-summary에 요약. cron 운영 감시의 최소 안전망입니다.
  • d-survivor readonly repo updater: hourly active, origin compare/read-only 패턴과 맞습니다.
  • web-design scout/deep 계열: 오전/저녁 lane별 active. 과거 과잉비용을 줄인 새 구조가 운용 중입니다.
  • Sonia wiki study 계열: music/game-industry/hype-cases가 active이고, 일부는 Discord 채널 전달. Son님의 “조사위키 기반” 운영과 맞습니다.
  • benefit/AI opportunity radar: source-pack + 검증/재배포로 구성되어 있고 최근 ok.

개선이 필요한 자동화

  • web-design 연구 cron 비용 추적: 경량화 후 실제 토큰 절감이 얼마나 되었는지 아직 7일 전체에는 과거 과잉 사용이 섞여 있습니다. 다음 주에는 lane별 비용/소요시간을 따로 보거나 insights 비교가 필요합니다.
  • 임시 브라우저/QA 프로세스 정리: sonia-toypetme 사건처럼 cron/browser QA가 사용자 일반 Chrome과 혼동될 수 있습니다. QA 프로세스 이름·포트·종료 로그를 cron 최종 output에 짧게 남기는 방안이 좋습니다.
  • paused cron 정리: SQAF, LifeOS, game scouting, service scouting, webview collision audit 등 paused job이 많습니다. 일부는 역사적 작업이고 일부는 재활성 후보입니다. paused가 많으면 운영자가 실제 active surface를 파악하기 어렵습니다.
  • curator stale 43개: dry-run은 변경 없음이지만, stale가 계속 누적되면 skills namespace 검색/로딩 비용과 인지 부하가 증가합니다.
  • report webview renderer 의존성: 이번 job은 HTML 웹뷰 링크 전용입니다. renderer 실패 시 fallback 규칙은 있지만, renderer 자체의 health/last deploy URL 감사 cron은 별도로 보이지 않습니다.

새로 만들 후보

  • 주간 cron 비용/상태 delta report: hermes insights --days 7와 cron list를 결합해 “새로 늘어난 고비용 cron / 실패/false-green 의심 / paused 정리 후보”만 짧게 보고.
  • QA 임시 프로세스 watchdog: Chrome/Node/Python 서버 중 sonia-*, report QA, Vite preview 등 Hermes가 띄운 임시 프로세스가 일정 시간 후 남아 있으면 #periodic-summary에 보고하거나 종료 후보 제안.
  • webview renderer smoke test: report_to_webview.py로 작은 fixture를 렌더·deploy하지 않는 로컬 smoke 또는 staging smoke를 주 1회 실행.
  • stale skills review digest: curator dry-run/status를 읽어 agent-created low-use/stale 상위 10개만 제안 모드로 보고.

6. 다음 주 우선순위

  1. Cron 비용 상한과 경량/심층 분리 원칙을 문서화
  2. 새 자동화는 기본값을 “경량 scout → 필요 시 deep”으로 두고, 브라우저/vision/subagent는 승격 후보에만 쓰도록 합니다.

  1. web-design research 경량화 효과 재측정
  2. 다음 주 hermes insights --days 7에서 web-design 관련 sessions/tokens/skill loads가 줄었는지 확인합니다. 줄지 않았다면 lane 수·frequency·toolsets 재조정이 필요합니다.

  1. QA 임시 프로세스 종료/표식 강화
  2. cron/browser QA가 띄운 프로세스는 이름·목적·포트·종료 여부를 산출물에 남기고, 종료 실패 시 periodic-summary에 노출하도록 개선합니다.

  1. Memory 정리 승인 배치 준비
  2. 이번 보고서의 memory 후보 중 2~4개만 선별해 replace/add 제안을 만듭니다. 특히 Hermes+Mac Mini 표현 정정, 3D 파이프라인 경계, 웹디자인 위키 호출 문구가 우선입니다.

  1. Skill patch 후보를 작게 적용
  2. 승인 후 web-interactive-app-systems에 3D 모델링 경계, web-design-reference-ops에 위키 우선 호출 문구, hermes-recurring-automation에 false-green 검증 체크를 보강합니다. 한 번에 대규모 rewrite 금지.

  1. Paused cron inventory 정리
  2. paused 작업을 “보존 / 재활성 / 삭제후보 / 문서화만”으로 분류합니다. 지금은 목록이 길어 운영 상황판이 탁해졌습니다.

  1. Curator consolidation은 아직 끄는 편 유지
  2. stale 43개가 있어도 자동 LLM consolidation은 비용과 오판 위험이 있습니다. 당분간 dry-run/status 기반의 제안 모드만 유지하는 편이 안전합니다.

7. 승인 요청

아래는 승인 없이는 수행하지 않을 변경 후보입니다.

  • [ ] memory 수정: Hermes+Mac Mini=AI autonomy lab... 항목을 현재 Windows Hermes host 중심 표현으로 약화/정정
  • [ ] memory 보강: “웹디자인 조사위키 기반”의 의미를 web-design-reference-ops + C:/Users/msi/sonia-wikis/web-design 우선으로 명시
  • [ ] memory 또는 skill 후보: 3D/GLB 작업에서 LLM은 고품질 모델 직접 제작보다 3D 생성/Blender/GLB/웹뷰어·배포 파이프라인 담당이라는 원칙 추가
  • [ ] skill patch: web-interactive-app-systems에 procedural 3D proxy vs production 3D pipeline 경계 추가
  • [ ] skill patch: web-design-reference-ops에 “위키 기반” 호출 문구와 session_search보다 위키 우선 원칙 추가
  • [ ] skill patch: hermes-recurring-automation에 status=ok false-green 방지 체크리스트를 더 짧고 강하게 정리
  • [ ] cron 개선: QA 임시 프로세스 watchdog 또는 cron-health-summary 확장 설계
  • [ ] cron 정리: paused cron inventory를 별도 보고서로 분류하고 Son님 승인 후 삭제/아카이브 후보 확정
  • [ ] curator 운영: agent-created low/no-use skills(spoken-voice-asset-production, integration-adapter-contract-testing, voice-and-tts-production)를 다음 주에도 미사용이면 archive 후보로 올리기

이번 주 판단은 간단합니다. Hermes는 많이 일했고, 대체로 실제 검증까지 수행했습니다. 다만 자동화는 아직 너무 성실하게 비싸지는 습관이 있습니다. Son님 환경에서는 “많이 하는 자동화”보다 “작게 확인하고, 깊게 갈 때만 깊게 가는 자동화”가 다음 안정화의 핵심입니다.