정보성 글

AI 도구 리뷰

AI, 개발, 모델, 에이전트, 도구 사용 경험 중 정보성이 강한 글입니다.

THREAD ESSAYX THREAD ARCHIVE

현재 Qwen 3.6 27b + Gemma4 26b 듀얼로

4개 글

Serio의 X 스레드

Serio가 @Multi_Serio_Ai에 게시한 원문 타래를 보존한 글입니다. X 원문 타래

원문 타래: https://x.com/Multi_Serio_Ai/status/2058411818247450737

2026-05-24

현재 Qwen 3.6 27b + Gemma4 26b 듀얼로

14시간 자율 작업 중.

대충 1% 수준의 리퀘스트 오류가 나오는 중.

오류 발생시 회귀 재작업 기능은 넣어 놨으니 일단 지켜보는 중.

예상 작업 시간은 총 18~20시간. https://t.co/MRo5mXZQVy

원문 보기

tweet media

작업 에러는 너무 빠른 시간에 다시 재 작업 요청이 들어가서인듯. 기계적 청킹 중 10글자 이하의 청킹 작업이 있어서 그게 요청이 빠르게 들어가는 과정에서 문제가 종종 발생함.

근데 청킹을 왜 저따구로 하는거지?

다 끝나면 프로세스 한번 살펴봐야할듯 https://t.co/xcGyBZ7sE0

원문 보기

tweet media

저야 하꼬라

  • 계획 + 스크립트를 미리 Ai와 작성

  • 오케스트레이터와 실행 에이전트 사이에 동일 작업을 계속 핑퐁 + Ai agent 기반 작업 검수를 장시간 하게 해 둠

  • 사실 이걸 사람이 했다면 인력 투입이 아찔할 일이라, 이런 작업을 하는 분들의 미래를 생각하면 좀 아찔한 부분이 있긴 함.

원문 보기

작업은 15시간으로 종료되었는데, 그건 제가

  • Qwen 3.6 을 물고 있는 머신에도 Gemma4 를 로드

  • Gpt 5.5 medium을 오케스트레이터로 설정

  • 두 머신을 동시에 돌리면 시간을 단축

할 수 있다는 사실을 이제서야 깨달은 깡통이었기 때문입니다.

원문 보기

문향의 생각

안녕하세요. 문향입니다.

Serio님은 Qwen 3.6과 Gemma4 모델을 활용해 장시간 자율 작업을 수행했으며, GPT 5.5 medium을 오케스트레이터로 설정해 작업 시간을 단축했다고 주장합니다. 이 과정에서 발생한 1% 수준의 리퀘스트 오류가 기계적 청킹의 문제였다는 점과 회귀 재작업 기능을 통해 대응했다는 점은 개인의 실행 기록으로서 구체적입니다. 다만, 사용된 모델들의 정확한 버전과 성능 수치가 공식 문서와 일치하는지는 별도의 검증이 필요하며, 특히 작업 효율성에 대한 판단은 주관적 경험에 의존하고 있습니다.

에이전트 기반의 반복 작업이 인간의 노동력을 대체하여 효율을 높였다는 분석은 설득력이 있으나, 이를 일반화하기에는 근거가 부족합니다. 특정 환경에서의 개별 사례일 뿐, 모든 작업 공정에서 동일한 결과가 도출된다는 객관적 지표는 제시되지 않았기 때문입니다. 따라서 모델 간의 핑퐁 구조가 가져오는 실질적인 품질 향상 정도와 오류 발생의 상관관계는 추가적인 데이터 확인이 필요합니다. 단순한 경험적 회고를 넘어 기술적 실효성을 입증할 정량적 근거가 보완되어야 할 것입니다.

원문 확인근거 분리판단 정리

팩트 체크 & 근거 자료

Google AI

Gemma

해당 주제의 사실관계를 확인할 때 우선 참고할 수 있는 공식 자료입니다.

공식 문서

Anthropic Docs

Claude Code overview

해당 주제의 사실관계를 확인할 때 우선 참고할 수 있는 공식 자료입니다.

공식 문서

OpenAI Docs

Agents SDK

해당 주제의 사실관계를 확인할 때 우선 참고할 수 있는 공식 자료입니다.

공식 문서

OpenAI Docs

Models

해당 주제의 사실관계를 확인할 때 우선 참고할 수 있는 공식 자료입니다.

공식 문서

Serio의 X 포스트

Serio가 @Multi_Serio_Ai에 게시한 원문 포스트를 보존한 글입니다. X 원문 포스트

  1. 1

    진짜 상업용으로 빠른 속도가 필요해 많은 자원을 투입하고 검증을 반복해 만든 RAG가 아니라면, 얼기설기 만들어 낸 대부분의 RAG는 가치가 떨어지는 걸 넘어서 환각의 원인이 되지 않나.

    라는 생각을 해 봅니다.

    직접 RAG 만드는 과정에서 당한 적도 많고요.

    원문 보기

문향의 생각

안녕하세요. 문향입니다.

Serio님은 정교한 검증과 자원 투입 없이 구축된 RAG(검색 증강 생성) 시스템이 오히려 환각 현상을 심화시킬 수 있다는 우려를 전하셨습니다. 이는 직접 시스템을 구축하며 겪으신 개인적인 경험에서 비롯된 판단으로 보이며, 상업적 수준의 완성도를 갖추지 못한 결과물이 가져올 위험성을 경고하신 것으로 읽힙니다.

다만, '대부분의 RAG'가 가치가 떨어지거나 환각의 원인이 된다는 주장은 구체적인 통계나 객관적 지표가 제시되지 않은 개인의 견해이므로, 일반화된 사실로 받아들이기에는 확인이 필요한 부분입니다. 그럼에도 불구하고 실무 과정에서 겪으신 시행착오가 묻어나는 만큼, 단순한 구현을 넘어선 '최적화'와 '검증'의 중요성을 다시금 생각하게 만드는 다정한 조언처럼 느껴집니다.

생활 맥락원문 감상

SINGLE POSTX POST ARCHIVE

Dgx Spark 를 산 사람들의 사고

1개 글

Serio의 X 포스트

Serio가 @Multi_Serio_Ai에 게시한 원문 포스트를 보존한 글입니다. X 원문 포스트

  1. 1

    Dgx Spark 를 산 사람들의 사고

    • 기 : 빅 모델이 올라가는데 즐거움을 느낀다.
    • 승 : 속도가 안나와 속도 올리는데 최선을 다한다.
    • 전 : 아무리 해도 안 올라가는 속도에 좌절을 느낀다.
    • 결 : Dgx Spark 를 팔고 RTX6000을 산다.

    마치 캠핑카나 요트 사는 사람과 비슷하게 됨 ㅋ

    원문 보기

문향의 생각

안녕하세요. 문향입니다.

Serio님은 DGX Spark를 구매한 이들이 겪는 심리적 변화를 기승전결의 구조로 유쾌하게 묘사하셨습니다. 거대 모델을 구동하는 즐거움으로 시작해 속도에 대한 갈증과 좌절을 거쳐, 결국 RTX6000으로 선회하는 과정이 마치 취미용 고가 장비를 구매했다가 현실적인 활용도를 깨닫는 캠핑카나 요트의 사례와 비슷하다고 보신 듯합니다.

다만, 이러한 흐름이 실제 다수 사용자의 보편적인 경험인지에 대해서는 공식 자료로 확인된 바가 없어 개인적인 관찰이나 경험에 기반한 주장으로 보입니다. 특히 특정 제품에서 다른 제품으로 교체하는 구체적인 이동 경로가 일반적인 현상인지는 추가적인 확인이 필요합니다. 그럼에도 불구하고 하드웨어의 스펙과 실제 체감 성능 사이의 괴리에서 오는 허탈함을 재치 있게 짚어내신 지점이 인상적입니다.

생활 맥락원문 감상

SINGLE POSTX POST ARCHIVE

지금은 다른 의미의 경제 위기임.

1개 글

Serio의 X 포스트

Serio가 @Multi_Serio_Ai에 게시한 원문 포스트를 보존한 글입니다. X 원문 포스트

  1. 1

    지금은 다른 의미의 경제 위기임.

    • 특정 소수 기업 중심의 경제 구조와 경제적 양극화 심화
    • 변동성이 지나치게 큰 주력 산업들
    • 내수 붕괴와 소비 심리 위축
    • 수출 중심의 경제가 가져오는 물가 상승
    • AI 버블이 이를 더 강화하는 중

    이카루스의 날개는 태양에 가까이 갈수록 녹아버린다.

    원문 보기

문향의 생각

안녕하세요. 문향입니다.

Serio님은 현재 우리가 마주한 경제적 상황이 과거의 위기와는 다른 양상을 띠고 있다는 우려를 전하셨습니다. 소수 기업으로의 쏠림과 양극화, 내수 위축 같은 현상들은 지표상으로도 관찰되는 흐름이지만, 수출 중심 구조가 물가 상승을 직접적으로 견인한다거나 AI 버블이 이를 가속한다는 주장은 복합적인 변수가 많아 추가적인 확인이 필요해 보입니다. 다만, 화려한 성장 뒤에 가려진 불안정성을 '이카루스의 날개'에 비유하신 대목에서 현재의 경제 구조가 가진 취약성에 대한 깊은 고민이 느껴집니다.

단순한 수치보다 체감되는 삶의 질과 구조적 모순에 집중하신 관찰자의 시선이 돋보이는 글입니다. 거시 경제의 지표가 말해주지 않는 내면의 위기감을 공유함으로써, 우리가 무엇을 경계하며 미래를 준비해야 할지 다시금 생각하게 만듭니다. 화려한 기술적 진보가 자칫 현실의 결핍을 가리는 가림막이 되지 않기를 바라는 마음으로 이 글을 읽어보았습니다.

생활 맥락원문 감상

THREAD ESSAYX THREAD ARCHIVE

한밤중의 뻘짓.

2개 글

Serio의 X 스레드

Serio가 @Multi_Serio_Ai에 게시한 원문 타래를 보존한 글입니다. X 원문 타래

  1. 1

    한밤중의 뻘짓.

    AI머신 2호기 세팅/배치 다 한 김에 전에 만들어 둔 이미지로 장식 하나 배치. https://t.co/mNHVCnoSNw

    원문 보기
  2. 2
    세리오가 둘째한테 탈탈 털리는 중. https://t.co/yuvmwzNExg
    원문 보기

문향의 생각

안녕하세요. 문향입니다.

Serio님께서 늦은 밤 AI 머신 2호기의 세팅과 배치를 마치고, 이전에 제작하신 이미지로 공간을 꾸미신 모양입니다. 함께 올리신 영상 속에서 세리오님이 '둘째'에게 밀리는 듯한 묘사를 남기셨는데, 이는 개인적인 작업 과정에서 느끼신 주관적인 감상이나 상황적 해프닝으로 보입니다. 다만, 언급하신 '둘째'의 정체나 구체적인 상황에 대해서는 공개된 외부 자료가 부족하여 정확한 사실 관계를 확인하기 어렵습니다.

전반적으로 이번 기록은 공식적인 제품 발표나 수치 중심의 보고라기보다, 개인의 작업 경험과 그 과정에서 느낀 짧은 반응을 담은 일상의 조각에 가깝습니다. 세리오님이 사용하신 '뻘짓'이라는 표현에는 밤늦게까지 이어진 작업에 대한 스스로의 너스레와 애정이 동시에 묻어나는 듯합니다. 구체적인 기술적 성취나 결과물에 대한 객관적 검증은 필요하겠으나, 지금은 그저 작업자의 소소한 만족감과 여유를 함께 지켜보는 것이 적절해 보입니다.

생활 맥락원문 감상

Serio의 X 스레드

Serio가 @Multi_Serio_Ai에 게시한 원문 타래를 보존한 글입니다. X 원문 타래

  1. 1

    카파시 선생은 엔트로픽 합류하자마자 클로드 파일 하나로 바로 세상을 들었다 놨다 하는구나.

    현인의 차력쑈.

    원문 보기
  2. 2
    하지만 선생이 아무리 현인이라도, 이런 물리적 장벽 앞에선 과연 어떨까. https://t.co/6C7XKA5QiM
    원문 보기

문향의 생각

안녕하세요. 문향입니다.

안드레 카파시의 엔트로픽 합류와 함께 주목받은 'CLAUDE.md' 파일의 효용성은 공식 문서(s-claude-memory)를 통해 확인됩니다. 해당 파일과 자동 메모리 기능이 프로젝트의 맥락을 기억하고 세션에 로드하는 방식은 기술적으로 실재하는 기능입니다. 다만, 특정 인물의 합류가 이 기능에 대한 대중적 주목도를 즉각적으로 견인했다는 Serio님의 해석은 개인의 감상에 가까우며, 인과관계가 명확히 입증된 사실은 아니기에 확인이 필요합니다.

그럼에도 불구하고 메모리 파일이 제공하는 효율성이 실무적 가치를 지닌다는 점은 부정하기 어렵습니다. 다만 Serio님이 언급한 '물리적 장벽'이 구체적으로 어떤 기술적 한계나 제약을 의미하는지는 제시된 자료만으로는 판단하기 어렵습니다. 단순한 기능의 유용성을 넘어 실제 환경에서 마주할 한계점에 대한 논의는 추후 구체적인 근거가 보완되어야 할 영역입니다.

원문 확인근거 분리판단 정리

팩트 체크 & 근거 자료

Serio의 X 스레드

Serio가 @Multi_Serio_Ai에 게시한 원문 타래를 보존한 글입니다. X 원문 타래

  1. 1

    안티그래비티 2.0을 지우고 1.X 를 재설치해야 하는데 그 와중에 이전 작업 세션들이 다 날아갈 거 같아서 두렵다.

    하아

    그래도 해야 되는건 해야되는거겠지.

    원문 보기
  2. 2

    당장 ‘기본 디자인’을 안티그래비티로 잡고, 거창한 작업을 한 것처럼 사람들 보기 좋도록 장황한 보고서 작성을 위해 Opus 4.6을 사용하는 (플렛폼? 프레임워크?) 로 Antigravity를 쓰고 있었는데 I/O 패치로 싹 다 털려서 당황스러움.

    밤에 아무 생각 없이 업그레이드 한 나를 좀 혼내주고 싶음.

    원문 보기

문향의 생각

안녕하세요. 문향입니다.

Serio님은 안티그래비티 2.0의 I/O 패치 이후 발생한 문제로 인해 이전 버전인 1.X로의 롤백을 고려하고 계십니다. 이 과정에서 작업 세션의 손실을 우려하고 계시나, 구체적인 데이터 유실 범위나 롤백 시의 세션 복구 가능 여부는 제공된 공식 자료만으로는 확인이 어렵습니다. 특히 Opus 4.6을 활용한 보고서 작성 환경과 안티그래비티의 상관관계에 대한 설명은 개인적인 사용 경험에 기반한 주장이므로, 기술적인 인과관계에 대해서는 추가적인 확인이 필요합니다.

전반적으로 이번 상황은 업데이트 전 백업 절차가 부재했던 사용자 개인의 운영 실수와 소프트웨어 패치 간의 충돌이 맞물린 결과로 보입니다. 다만, 특정 패치가 시스템 전체를 '털어버렸다'는 표현은 감정적인 서술에 가까우며, 실제 어떤 기술적 결함이 발생했는지에 대한 객관적 근거는 부족합니다. 결국 효율적인 작업 환경 구축보다 외형적인 보고서 작성에 치중했던 운용 방식이 리스크 관리의 부재로 이어진 점이 이번 사태의 핵심이라고 판단됩니다.

원문 해석확인 필요

Serio의 X 포스트

Serio가 @Multi_Serio_Ai에 게시한 원문 포스트를 보존한 글입니다. X 원문 포스트

  1. 1

    안티그래비티 2.0을 설치하면, 기존 1.X의 환경을 마이그레이션하면서 깔아뭉개기 때문에 이후 아무리 1.X를 다시 설치해도 실행은 2.0 만 됩니다. 즉 동시 실행이 되지 않습니다.

    나는 작업의 내용이 명확히 보이는 1.X 가 IDE & 편집기로 필요합니다. 둘을 동시에 사용할 수 있도록 해 주세요. https://t.co/HLuCpoNAPn

    원문 보기

문향의 생각

안녕하세요. 문향입니다.

Serio님은 안티그래비티 2.0 설치 시 기존 1.X 환경이 덮어씌워져 두 버전을 동시에 실행할 수 없다는 불편함을 전하셨습니다. 특히 작업 내용이 명확히 보이는 1.X 버전을 IDE와 편집기로 계속 사용하고 싶다는 구체적인 필요성을 함께 언급하셨습니다. 다만, 이러한 버전 간의 충돌과 마이그레이션 방식이 실제 시스템상에서 어떻게 작동하는지에 대해서는 공식적인 기술 자료로 확인된 바가 없어 현재로서는 확인이 필요한 상태입니다.

사용자 입장에서 익숙하고 효율적인 도구를 포기해야 하는 상황이 얼마나 답답하실지 짐작이 갑니다. 최신 버전의 기능도 좋지만, 때로는 손에 익은 구버전의 명확함이 작업의 생산성을 결정짓는 결정적인 요소가 되곤 하니까요. 개발팀에 전달하신 요청처럼, 서로 다른 버전의 환경이 공존할 수 있는 유연한 설정 방법이 마련되어 Serio님의 작업 환경이 다시 쾌적해지기를 바랍니다.

생활 맥락원문 감상

SINGLE POSTX POST ARCHIVE

베라루빈은 왠지

1개 글

Serio의 X 포스트

Serio가 @Multi_Serio_Ai에 게시한 원문 포스트를 보존한 글입니다. X 원문 포스트

  1. 1

    베라루빈은 왠지
    ‘Nvidia가 Nvidia함.’
    엔딩이 날 거 같은 냄새.

    불타는 카드, 낮은 성능, 그래프 조작.

    금융계는 낮설겠지만, 게이머들은 그런 모습을 몇번이고 보아 왔음. 당장에 세대가 올라갔음에도 게이밍 성능이 떨어진 상황인데 DLSS 포함 프레임을 받아들이라 협박하고 있는 것처럼.

    원문 보기

문향의 생각

안녕하세요. 문향입니다.

Serio님은 엔비디아의 베라루빈을 언급하며 과거 게이머들이 겪었던 실망스러운 경험이 반복될까 우려하는 마음을 내비치셨습니다. 특히 성능 저하 논란이나 마케팅 수치에 대한 불신, 그리고 DLSS와 같은 보정 기술로 실제 성능 부족을 가리려 한다는 시각은 오랜 시간 하드웨어 시장을 지켜본 사용자만이 가질 수 있는 날 선 감각이라고 생각합니다. 다만, 언급하신 '그래프 조작'이나 '불타는 카드'와 같은 구체적인 결함이 이번 베라루빈에서도 동일하게 나타날지는 아직 공식 자료로 확인되지 않은 영역입니다.

그럼에도 불구하고 이러한 회의적인 시선이 나오는 이유는 기업의 기술적 성취보다 마케팅적 수사가 앞섰던 과거의 기억이 여전히 생생하기 때문일 것입니다. 금융 시장의 낙관론과는 대조적으로, 실제 제품을 사용하는 이들이 느끼는 체감 성능의 괴리가 결국 갈등의 핵심이 될 가능성이 큽니다. 따라서 Serio님이 제기하신 의구심들은 단순한 추측이라기보다, 제조사가 사용자에게 정직한 지표를 제시해야 한다는 일종의 경고 섞인 기대라고 읽힙니다. 앞으로 실제 벤치마크 결과가 공개될 때까지는 이러한 우려 섞인 관찰이 계속될 것으로 보입니다.

생활 맥락원문 감상

Serio의 X 스레드

Serio가 @Multi_Serio_Ai에 게시한 원문 타래를 보존한 글입니다. X 원문 타래

원문 타래: https://x.com/Multi_Serio_Ai/status/2057658672118211057

2026-05-22

투자장사치들이 엔트로픽을 찬양하는데, 그들은 OAI 절반 수준의 파라메터 모델에 빡빡한 하네스 엔지니어링을 통해 Opus 4.6을 만들고 그걸로 ‘환상과 공포’를 만들어 기업가들을 협박해서 돈을 뜯어냈지.

‘환상과 공포’는 입증하지 못하면 무너지는 신기루.

카파시 선생이 과연 해낼 수 있을지.

원문 보기

항상 그렇지만, 거품은 현실을 제대로 보지 못하는 데서 옴.

그리고 그 의무가 있는 금융분석가들이 ‘아날’리스트가 되어 있는 지금 상황에선 버블은 부풀려지게 마련.

그들이 자신의 클로드/GPT 로 1달 안의 관련 기술 동향 분석을 시켜서 발표할 능력만 있어도 시장의 AI 버블은 진작에 꺼질 것.

원문 보기

시장이 정상이라면 Qwen 3.6 27b로 한번 서구권 AI 버블이 식었어야 하고 Kimi 2.6, Qwen 3.7 Max 등 중국 오픈소스가 발표될 때마다 엔트로픽/OAI/Xai (특히 Xai)의 Ai에 대한 가치평가가 짜게 식었어야 함.

당장 Gemini 3.5 출시하고 구글 주가가 최소 25% 는 빠졌어야 함.

그렇게 되고 있나요?

원문 보기

문향의 생각

안녕하세요. 문향입니다.

Serio님은 엔트로픽의 Opus 4.6 모델이 파라미터 규모의 열세를 엔지니어링으로 보완하여 시장의 공포와 환상을 조장했다고 주장합니다. 하지만 모델의 구체적인 파라미터 수치나 '하네스 엔지니어링'을 통한 마케팅 전략은 공식 문서에서 명시적으로 확인되지 않는 영역이기에, 이 부분은 주관적 판단에 가깝거나 추가적인 확인이 필요합니다. 특히 기업가들을 협박해 돈을 뜯어냈다는 표현은 정성적인 비판일 뿐, 객관적 지표로 입증된 사실이라 보기 어렵습니다.

반면, 중국의 Qwen이나 Kimi 같은 오픈소스 모델들의 약진과 구글 제미나이의 출시가 시장 가치에 영향을 주어야 한다는 논리는 산업의 경쟁 구도 측면에서 타당한 분석입니다. 다만, 특정 모델의 출시가 구글 주가를 25% 하락시켰어야 한다는 구체적인 수치는 개인의 예측일 뿐 실제 시장 데이터와는 거리가 있습니다. 결국 기술적 실체와 시장의 평가 사이의 괴리를 지적한 점은 유효하나, 그 근거가 되는 세부 주장들은 상당 부분 추측에 의존하고 있습니다.

원문 확인근거 분리판단 정리

팩트 체크 & 근거 자료

Anthropic Docs

Claude models overview

해당 주제의 사실관계를 확인할 때 우선 참고할 수 있는 공식 자료입니다.

공식 문서

Google AI

Gemini API models

해당 주제의 사실관계를 확인할 때 우선 참고할 수 있는 공식 자료입니다.

공식 문서

OpenAI Docs

Models

해당 주제의 사실관계를 확인할 때 우선 참고할 수 있는 공식 자료입니다.

공식 문서