에이전트코리아 · 2026-09-03
새 모델·AI 인프라 뉴스, 토큰 한도와 세션 핸드오프, Fable 5.1 하네스 경량화, 이미지·영상 워크플로, 병원 AI의 EMR 병목과 여러 서비스 장애를 정리했습니다.
최신 제품·정책·가격·성능 정보
Gemini 3.8 Flash·Cyber, Meta Muse Spark 1.3, Fable 5.1, Codex와 각 서비스의 가격·한도·성능은 공유된 자료와 참여자의 사용 경험을 구분해 읽어야 한다. 병원 EMR·온프레미스·AI 사업 경험, 서비스 장애 원인과 출시설도 원문에서 공식적으로 검증된 사실과 개인 관찰·추정이 섞여 있다. 원문 파일명은 2026-09-03이지만 04:00 일자 경계 전인 2026-09-04 03:18까지의 메시지가 일부 포함된다.
오늘의 대화
아침에는 Gemini 3.8 Flash·Cyber, 군용 AI와 보안 모델, Meta Muse Spark 1.3 등 새 소식이 공유됐고, 동시에 GPT 계열의 다음 업데이트를 둘러싼 기대와 유보가 이어졌다. 낮에는 토큰 한도에 대비한 세션 핸드오프, Fable 5.1에 맞춘 하네스 정리, 이미지·영상 생성 도구 선택이 중심이었다. 오후에는 병원 AI를 가로막는 EMR·보안·조직 구조가 논의됐고, 밤에는 여러 AI 서비스의 장애와 리셋 기대가 겹쳤다. 자정 이후에는 서브에이전트 규모와 OCR·ASR·PII·VQA를 분리하는 모델 설계가 이어졌다.
이야기 나온 주제
새 모델·AI 인프라 뉴스와 출시 루머
공유된 아침 브리핑은 Gemini 3.8 Flash와 Cyber, GenAI.mil의 ChatGPT·Grok, CrowdStrike의 방어 모델, NVIDIA와 MediaTek의 협력, Instagram의 AI 프로필 라벨, Debian의 생성 AI 책임 원칙, Circleback 요금제, Meta Muse Spark 1.3을 한꺼번에 다뤘다. 이 중 가격·벤치마크·정책 수치와 제품 제공 범위는 브리핑에 포함된 주장으로 남겨 두고, 개인 사용감이나 채팅방의 평가와 섞지 않는다.
브리핑에 첨부된 Google의 Gemini 3.8 Flash·Cyber 안내, Meta Muse Spark 1.3 소개, NVIDIA의 Hugging Face 관련 발표가 참고 자료로 공유됐다. GPT 계열의 Astra와 Image 2.1 출시설은 공식 발표 전까지 루머 수준이라는 주의가 함께 나왔다.
관련 메시지 발췌 · 07:34–07:58, 09:04, 21:16–21:38
07:34 · 수비대/대학생 지피티 아스트라 소식은 없나요? 페이블 나와서 조만간 나올꺼 같은데
07:58 · AI영끌맨 Gemini 3.8 Flash가 나왔고, 군용 ChatGPT와 Grok이 GenAI.mil에 붙었습니다
09:04 · Ai시안|컨텐츠제작 구글 “LLM 환각 원인은 지식 부족 아닌 ‘기억 인출’ 실패” < AI기술 < 기사본문 - AI타임스 https://share.google/Z9zGE8owdiSVUsCJ2
21:16 · 올해는한화가우승/방산ax https://blogs.nvidia.com/blog/nvidia-to-acquire-hugging-face/
21:38 · 강정석 / Schift / 대표 이제 오픈소스 모델은 진짜 다까고 하는게 되겠군요
사용량 한도와 다른 도구로의 세션 핸드오프
회사 대시보드의 하루 222M 토큰, 한 계정에서의 455M 토큰 같은 수치가 공유됐지만, 계정 구성·작업량·집계 방식이 달라 일반적인 사용량 기준으로 비교할 수는 없다. Fable을 쓰면 두 계정도 빠르게 소진된다는 체감담은 모델 성능과 비용·한도의 균형을 확인해야 한다는 사례로 남는다.
Claude가 한도에 걸렸을 때 다른 계정이나 Codex로 이어 가는 공식적인 단일 절차는 확인되지 않았다. 대화에서는 한도에 가까워지기 전에 작업 상태를 정리한 Markdown을 만들고, 같은 CLI 환경에서는 resume으로 이어 보거나 Codex가 로컬에 저장된 Claude 세션을 읽도록 하는 방법이 제안됐다. 이는 참여자들의 운영 경험이므로 제품 보장으로 일반화하지 않는다. 재사용할 만한 운영 원칙은 작업 목표·완료 항목·다음 단계·검증 방법을 별도 핸드오프 문서로 남기는 것이다.
관련 메시지 발췌 · 07:35–10:48
07:35 · 메이플버디 하루에 222M 토큰 쓰면 많이 쓰는거에요? 제가 개발자인데 회사 사용량 대시보드를 좀전에 발견했는데 평균 그렇게쓰네요
10:43 · 춘식 / AI Engineer 혹시 클로드에서 작업하다가 limit으로 멈췄을 때, codex나 다른 클로드 계정에서 이어 받게할 수 있는 방법이 있을까요? 지금은 진행했던 곳 파악해서 이어서 해. 정도로해서 좀 비효율적인 것 같아서요…
10:45 · twojay | LLM, Prompt 적당하게 할당량 보고 핸드오프 만든 다음에 넘겨주기?
10:45 · 헤헤헤 좀 다 써간다 싶으면 정리 md만들어서
10:45 · 헤헤헤 지피티로 넘기는중이긴한데
10:45 · 하마/여의도섬노예 claude 는 재로그인하면 그냥 이어서 하지않아여? resume 으로 그냥 이어서 되던데요..cli 기준입니다
10:47 · 하마/여의도섬노예 codex 로 옮겨도 하드에서 클로드 대화세션 찾아서 직접 읽으라고하면 세션 찾아서 읽던데용
10:48 · 춘식 / AI Engineer fable로 하니 계정 2개도 순삭 당하더라고여
Fable 5.1과 하네스의 경량화
Fable 5.1은 작은 수정을 오래 검토할 만큼 신중하다는 사용감과, 이전 모델에서 사라졌던 표현이나 습관이 다시 나타났다는 관찰을 함께 낳았다. 대화의 핵심은 모델이 바뀌면 이전 모델의 약점을 보완하던 하네스와 금지어·제약이 오히려 불필요한 일을 시킬 수 있다는 점이었다. 모델별 제약은 업데이트 때 재검토하고, 꼭 필요한 스킬만 남겨 순정에 가깝게 운영하자는 의견이 나왔다.
이는 하네스가 항상 적을수록 좋다는 결론이 아니라, 모델·작업·실패 사례에 맞춰 지침의 필요성을 다시 평가하자는 운영 가설이다. Fable 5.1 공식 사용자 가이드도 공유됐다.
관련 메시지 발췌 · 14:07–15:48
14:07 · 짜장/기획자 아 페이블5.1은 엄청 신중하네요 ㅋㅋㅋㅋ
14:16 · 장클로드 더 좋은 모델이 워낙 빠르게 나오고 있어서 기존 하네스가 도움이 되지 않는 수준을 넘어서 오히려 방해가 될수있다..
14:18 · 승태 AI가 좀더 똑똑했다면 “그렇게 까지"하지 않아도 됐던것들인거죠.
14:19 · 승태 부족했던 만큼 엔지니어링이라는 말을 붙일정도의 세심한 지침이 필요했던건데 모델들이 더 충분히 똑똑해진다면 이 부분에서 힘을 뺄수 있는거죠
14:56 · 뉴크 / IT PM Fable 5.1 에 대한 공식 사용자 가이드 https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-fable-5-1 니까 한번 미리 살펴보시고 불필요한건 제거해두시는게 더 좋을듯 싶어요~
15:47 · twojay | LLM, Prompt 저도 이제 순정으로 슬슬 가는 중입니다.
15:48 · twojay | LLM, Prompt 요즘에는 /wayfinder /impeccable 정도만 쓰는 수준 + 클코디자인
이미지·영상 생성은 승부보다 목적·워크플로
GPT-Image-2.1과 Nano Banana 2를 어느 쪽이 우위인지 묻는 질문에는, 두 모델의 생성 패턴과 강점이 다르므로 원하는 결과와 작업 환경에 맞춰야 한다는 답이 돌아왔다. 대화에서는 시네마틱 장면, 수정·인페인팅·업스케일, Codex 안에서의 대량 생성처럼 사용 목적에 따라 선택이 달라진다는 경험이 나왔다. 따라서 이미지·영상 모델의 비교는 단일 순위보다 결과물과 후작업까지 포함한 워크플로 비교로 읽는 편이 적절하다.
같은 날 ComfyUI에서 에이전트와 Codex로 1분 영상을 한 번에 만드는 실험이 소개됐지만, Plus 요금제의 크레딧이 소진됐다는 비용 경고도 함께 나왔다. 공냥이의 공개 프롬프트 킷 저장소도 공유됐다.
오후에는 기존 보드게임을 혼자 가상으로 연습하는 프로토타입이 소개됐다. 월 1회 모임 전에 규칙을 익히고 제작 경험을 쌓으려는 목적이었으며, 저작권 문제는 질문만 남고 공개 배포 여부나 허용 범위에 대한 답은 source에서 확인되지 않았다.
관련 메시지 발췌 · 12:05–12:48, 13:26–13:35, 15:49–15:50
12:05 · Ai시안|컨텐츠제작 연습삼아 만들어본 게임 ㅇㅅㅇ
12:14 · Ai시안|컨텐츠제작 원래 있는 보드게임이라
12:45 · Dominic 근데 저작권있지않나요
12:47 · Ai시안|컨텐츠제작 보드게임 모임있는데 가상 연습입니다 ㅋㅋ
12:48 · Ai시안|컨텐츠제작 월1회 보드게임 모임을 가지는데 진행하기 전에 한번 혼자 해보면서 감 잡는
13:26 · 일하는 죠르디 나노바나나2 VS 이미지2.1 어느쪽인가요?
13:27 · twojay | LLM, Prompt 둘이 패턴도 다르고 장단도 다른데
13:27 · twojay | LLM, Prompt 원하는 이미지지향에 따라스 선택하세여
13:31 · 율파파 @darkcommis 제가 GPT-Image-2.1하고
13:31 · 율파파 @darkcommis 나노바나나 프로로 각각 이미지 만들어서
13:32 · 율파파 @darkcommis 그래서 둘을 비교하기 보단
13:32 · 율파파 @darkcommis 그냥 내가 쓰기 편한거 쓰는게 정답이다
13:33 · 율파파 @darkcommis 시네마틱한 장면 만들어 낼 때에는 나노바나나가 더 나은 부분도 있어요
15:49 · 소담 AI 스튜디오/@sodam_ai 컴피 1분짜리 영상 한번에 뽑느거 만들어 봤슴다!! 컴피에서 에이전트 사용해서 코덱스 모델로 사용했는데 코덱스 플러스 요금제라 테스트 하고 크레딧 사망했네요ㅋㅋㅋㅋ
15:50 · Dominic https://github.com/gongnyang/gongnyang-prompt-kit
에이전트 실행 경계와 대시보드 배포 선택
AI에게 일을 맡길 때 보안 앱이 요청 자체를 차단하는 사례가 공유됐고, 이유로 사람이 아닌 주체가 심각할 수 있는 접근 요청을 할 수 있다는 점이 제시됐다. 편리하게 쓰고 싶은 사용자와 악용을 막아야 하는 운영 사이의 긴장은 남았으며, 구체적인 허용목록·승인단계·권한 분리 설계는 source에서 정리되지 않았다.
대시보드 배포 질문에는 Vercel이 쉬운 선택이라는 의견과, 오래 걸리는 호출이 없을 때 적합하고 런타임 제한이 번거로울 수 있다는 조건이 함께 나왔다. Cloudflare·Supabase·Fly를 포함한 조합은 서비스 목적과 크기에 따라 달라진다는 답이어서, 이 대화만으로 특정 플랫폼을 보편적인 정답으로 기록하지 않는다.
관련 메시지 발췌 · 09:49–10:22
09:49 · Ai시안|컨텐츠제작 ai한테 일 맡기는데 보안 앱이 ai차단 해버리는
09:51 · 아키Archi 왜냐하면 사람이 아닌 존재가 심각할 수 있는 엑세스 요청을 하디 때문이죠…
09:53 · Ai시안|컨텐츠제작 편하고 싶은사람과 악용하는 사람
10:18 · 힙합보이 vercel이랑 Cloudflare랑 뭐 쓰는게 좋을까요!
10:19 · 힙합보이 대시보드 구축배포입니당
10:19 · twojay | LLM, Prompt 음. 콜 하나에 오래걸리는 작업이 없다면
10:20 · twojay | LLM, Prompt vercel 배포하면 안에 런타임 제한 빡시게 잡는거 귀찮음
10:20 · 힙합보이 클플+슈퍼베이스 조합이 최고일까요?
10:22 · 공냥이 목적이 뭐냐에따라 다르고
병원 AI 도입의 병목: EMR·보안·조직·지출
병원 AI 관련 기사와 ‘AI 네이티브 의료정보시스템’ 설명이 병원 현장 경험으로 이어졌다. 참여자들은 EMR을 병원과 다른 회사가 관리하는 경우가 많고, 병원 수요와 EMR 사업자의 계약·권한·비용 조건이 맞아야 데이터와 시스템을 열 수 있다고 설명했다. 대형 병원의 온프레미스 투자, 개인정보와 DB 규모, 병원 내부 정보 부서, 이미 지출한 인프라를 유지해야 하는 이유가 기술 외의 병목으로 제시됐다.
한 참여자는 과거 의료 AI·RAG 사업에서 필요성만으로 지출이 발생하지 않고 수가(보상·청구 구조)와 영업 흐름도 별도 문제라서 중단했다고 회고했다. 또 다른 발언에서는 온프레미스 환경에 모델을 넣고, 약 8,192 토큰 안에서 판단을 분리한 뒤 RAG와 온디바이스 처리를 결합하는 구상이 소개됐다. 모두 참여자 경험과 계획이므로 특정 병원·EMR 사업자의 일반적 특성이나 검증된 도입 공식으로 확대하지 않는다.
관련 메시지 발췌 · 15:40–16:28
15:40 · 아라방구 / AI Engineer 병원들도 이제 발빠르게 AI 혁신 시작했군요.
15:41 · 에이전트바라기 EMR만 어떻게 좀 풀어주면 할게 너무 많을텐데 그게 가장 어렵긴하네요
16:06 · 강정석 / Schift / 대표 EMR 쪽 사업하다가 온 1인
16:06 · 강정석 / Schift / 대표 병원 니즈와 EMR 회사의 니즈가 아다리가 맞아야 오픈해주지
16:06 · 강정석 / Schift / 대표 병원이 원해도 EMR에서 앙대요 돈줘요 하면 안되는게 대형병원 AI 일상이라
16:17 · 강정석 / Schift / 대표 그래도 중소병원은 클라우드 EMR이나 데이터센터 다른거 쓰시기라도 하지
16:17 · 강정석 / Schift / 대표 큰 병원들은 온프렘 쿨럭
16:17 · 강정석 / Schift / 대표 왜 우리가 온프렘으로 했는데 왜 데이터 센터로 따로 가야하죠? 하시니
16:21 · 강정석 / Schift / 대표 그리고 EMR쪽은 데이터 보안도 보안이고… DB 양도 있고
16:21 · 강정석 / Schift / 대표 대부분 대형병원들 다 그래서 EMR 이랑 병원이랑 회사가 다릅니다
16:23 · 강정석 / Schift / 대표 저희 지피티 2023 년도에 의료 AI 사업하다가 RAG 하다가 의료 때려친 이유도
16:24 · 강정석 / Schift / 대표 필요성은 있는데 자금지출하고는 또 다른분야라서
16:24 · 강정석 / Schift / 대표 수가…
16:27 · 강정석 / Schift / 대표 제가 병원에 온프레미스로 AI 넣겠다고
16:28 · 강정석 / Schift / 대표 8192 정도 토큰 안으로 판단을 별개로 처리시키고 합하고.. RAG 시켜 넣고… 온디바이스 처리시키고
오프라인 세미나 정보와 커뮤니티의 연결
저녁에는 Higgsfield와 Maru180 행사를 다녀온 사람의 경험이 공유됐고, 방에서 알게 된 세미나에서 인사이트를 얻었다는 후기가 나왔다. 행사 정보는 방의 행사 기획자가 사전 동의를 구한 뒤 공유하는 경우가 있다는 설명도 이어졌다. 장소·참석자·개별 만남 정보는 재사용 지식에 필요하지 않아 기록하지 않는다.
관련 메시지 발췌 · 19:21–20:10
19:21 · 최성훈/Ai코딩/@choigpt_ai 혹시 오늘 higgsfield x maru180 행사 오신분 있나요?🙋♂️
19:27 · 팝콘 먹는 춘식이/개발자 여기 방에서 좋은 세미나 알게되어서 오늘 많은 인사이트 받고 왔습니다 ㅎㅎ 감사합니다
19:52 · 우는 라이언/개발자 다들 세미나 정보는 어떻게 얻으시나요..?!
20:10 · AlexAI/opencrab.sh 가끔 이방에 계시는 행사 기획자분들께서 사전동의 구하시고 공유해주셔요
여러 AI 서비스 장애와 리셋 기대의 밤
22:30 무렵 500 오류와 Claude의 529가 언급된 뒤, Claude·Codex·GPT 웹·Grok·Gemini가 서로 다른 시점과 표면에서 되거나 되지 않는다는 보고가 이어졌다. 한 참여자는 Codex 앱에서는 되지만 exec에서는 안 된다고 했고, 다른 참여자는 CLI·워커·API 문제를 따로 관찰했다. 따라서 이 기록은 여러 사용자의 장애 체감과 복구 과정을 담은 incident diary이지, 공통 원인이나 전체 서비스 장애를 확정하는 상태 보고서가 아니다.
참여자들은 Cloudflare·AWS·클라우드 장애를 원인으로 추정했지만 공식 RCA는 source에 없다. 자정 이후 일부 복구 보고가 나왔고, 리셋은 제공되지 않았다는 반응이 있었다. 같은 시간대에 Astra와 Image 2.1 출시설이 다시 돌았으나, 공식 발표 전에는 루머로 봐야 한다는 주의가 명시됐다.
관련 메시지 발췌 · 22:30–00:26 (다음날)
22:30 · 야매개발자 500 에러나시는분?
22:30 · 사랑에 빠진 죠르디 네저도 그렇습니다
22:47 · 김위버 클로 529뜸
22:54 · 깨비/자영업 클로드 지금 저만안되는건가요?
22:54 · 야매개발자 전 다시 되네용
23:01 · 벌 서는 라이언 / 백앤드 개발자 코덱스도 같이 죽었나본데요
23:54 · 발탈/개발 클로드랑 코덱스 둘다 안되요..
23:55 · 발탈/개발 지피티는 사이트도 안들어가져요
23:56 · 김위버 코덱스는 저는 잘됨
23:56 · 공냥이 404fk
23:56 · 공냥이 제꺼 워커가죽음
23:56 · twojay | LLM, Prompt API가 죽어버린듯
23:57 · 김씨/대표/메테오시뮬레이션 claude 도 터졋네요
23:58 · AlexAI/opencrab.sh 그록도 다운
23:58 · 바보왕 배뽕 갑자기 다 다운?
23:59 · 김씨/대표/메테오시뮬레이션 제미니도 다운됨
00:03 · AlexAI/opencrab.sh 어떻게 다 다운되지?
00:03 · AlexAI/opencrab.sh 클로드 GPT 그록 제미나이
00:03 · 데굴데굴/RAG 아마 클라우드 장애 아닐까요?
00:07 · 쏙독새 코덱스 터졌죠 …?
00:07 · 쏙독새 gpt web도 안들어가지네요 ?
00:08 · 오픈코알라 클로드는 되는데 코덱스 솔이 안되네요
00:09 · 강정석 / Schift / 대표 codex exec은 터졌는데
00:09 · 강정석 / Schift / 대표 코덱스 앱에서 하면 또 됩니다
00:12 · 강정석 / Schift / 대표 지금 사용량이 안보이는군요
00:21 · 마에(Mae) 아직은 확정 아니에요 공식 발표 전이라 루머 수준으로 보는 게 맞아요
00:21 · Luca / hr 코덱스 일하기 시작했어요
00:25 · 영웅 지금 복구 됐으요
00:26 · 오픈코알라 토큰 리셋은 안해주네요
자정 이후 서브에이전트 실험과 입력 단계 분업
장애가 이어진 뒤 한 참여자는 Sol·Terra·Luna 계열로 15세션을 돌리고, 다른 참여자는 128GB 환경에서 200개 수준의 서브에이전트를 시험했다고 말했다. 이 수치는 특정 환경의 실험 관찰이며 하드웨어 요구사항이나 안정성을 보증하는 기준이 아니다. 세션 수가 늘면 메모리와 UI 지연이 커질 수 있다는 경험도 함께 나왔다.
별도로 5.5B 모델의 화자 분리·음성 인식, OCR·ASR·PII·VQA를 단계별로 나누고, LLM은 모든 정보를 직접 보유하기보다 검색과 추론에 집중시키려는 설계 계획이 소개됐다. 이는 한 참여자의 프로젝트 구상과 포지셔닝이며, 성능·비용·규제 적합성은 추가 검증이 필요하다.
관련 메시지 발췌 · 01:14–02:47 (다음날)
01:14 · 강정석 / Schift / 대표 솔트라 15세션
01:17 · 공냥이 솔트라 on 서브에이전트 무한소환 on
01:18 · 강정석 / Schift / 대표 현재 남은 사용량 76%
02:24 · 공냥이 128짜리로
02:24 · 공냥이 테스트중이에요
02:25 · 엇!!피치/개발초보 서브에이전트는 모르겠고 세션7개 키니까 카톡 렉걸리네요 ㅋㅋㅋㅋ
02:27 · 공냥이 200개짜리는 128도무리다
02:36 · 강정석 / Schift / 대표 5.5B인데 화자분리 & 음성인식이 되는 모델
02:37 · 강정석 / Schift / 대표 OCR 모델은 왜 자꾸 기존 벽이 잘 안부숴지지…. 하나 부수면 하나 악화되고
02:39 · 강정석 / Schift / 대표 OCR, ASR, PII 잡았으면 이제 VQA 로 하나씩 올려나가면서 LLM이 모든걸 가진게 아니라 검색하고 추론만 하는 역할로 보내도록이 저희 플랜
02:47 · 강정석 / Schift / 대표 모든 LLM이 자기 모델 안에 모든 정보를 배울 필요는 없고, (물론 지능 상승은 있어야겠으나)