• 생성형 AI 인프라 구축 전략: 온프레미스 GPU 서버, 클라우드 GPU 및 Managed API의 총소유비용(TCO) 및 경제성 비교 분석

    생성형 AI 인프라 구축 전략: 온프레미스 GPU 서버, 클라우드 GPU 및 Managed API의 총소유비용(TCO) 및 경제성 비교 분석

    AI 인프라 의사결정의 핵심 패러다임 기업이 생성형 인공지능(Generative AI) 및 대규모 언어 모델(LLM)을 도입할 때 직면하는 가장 중대한 재무적·기술적 의사결정은 온프레미스(On-Premise) GPU 인프라를 직접 구축할 것인지, 클라우드 GPU 인프라(IaaS/Neocloud)를 임대할 것인지, 아니면 관리형 AI 플랫폼 및 API(SaaS/PaaS)를 활용할 것인지 선택하는 문제입니다. 과거 정보기술(IT) 인프라 도입 패러다임이 단순히 자본지출(CapEx)과 운영지출(OpEx)의 재무적 전환에 집중되었다면, 초고성능 GPU 인프라…

  • RAG 시스템, 어떻게 평가해야 할까? — RAGAS로 정량적 품질 검증

    RAG 시스템, 어떻게 평가해야 할까? — RAGAS로 정량적 품질 검증

    들어가며 LLM의 할루시네이션을 극복하기 위한 대안으로 RAG(Retrieval-Augmented Generation)가 나왔지만, RAG에서도 어떻게 설정하는가에 따라 품질이 극명하게 갈립니다. 결국 RAG(Retrieval-Augmented Generation)를 구축해서 벡터 DB 검색과 LLM 답변 생성이 정상적으로 동작하는 걸 확인했다고 해서 끝이 아니란 이야기 입니다. “답이 그럴듯하게 나온다”와 “답이 실제로 정확하고 근거가 있다”는 전혀 다른 이야기이기 때문입니다. RAG는 두 단계로 구성됩니다. 이 두 단계가 유기적으로…

  • Gunicorn 완전 정복: Unix용 파이썬 웹서버의 정석

    Gunicorn 완전 정복: Unix용 파이썬 웹서버의 정석

    Gunicorn이란? Gunicorn(그린 유니콘, Green Unicorn)은 Unix 계열 운영체제에서 동작하는 파이썬용 WSGI HTTP 서버입니다. 루비(Ruby)의 Unicorn 프로젝트에서 영감을 받아 이식된 프로젝트로, “빠른 클라이언트와 게으른 애플리케이션을 위한” 서버라는 슬로건 그대로 단순한 구조와 가벼운 자원 사용, 폭넓은 프레임워크 호환성을 무기로 2010년부터 지금까지 파이썬 웹 서비스 배포의 사실상 표준으로 자리 잡고 있습니다. 프로젝트는 gunicorn.org와 GitHub – benoitc/gunicorn에서 관리되며, 이…

  • 생성형 AI 이후의 패러다임 전환: 기업 AI 에이전트 개발 투자 타당성 및 시장 전망

    생성형 AI 이후의 패러다임 전환: 기업 AI 에이전트 개발 투자 타당성 및 시장 전망

    대화형 코파일럿에서 자율형 에이전트 모델로의 구조적 격변 생성형 인공지능 기술의 발전 축이 대형언어모델(LLM) 기반의 단발성 프롬프트-응답 체계에서 자율적 목표 달성을 지향하는 에이전트형 AI(Agentic AI)로 급격히 전환되고 있습니다. 기존의 기술이 인간 사용자의 명시적 지시에 따라 텍스트를 생성하거나 데이터를 요약하는 수동적 코파일럿(Copilot)에 머물렀다면, AI 에이전트는 주어진 상위 목표를 스스로 해석하여 세부 작업으로 분해하고, 필요한 외부 시스템 도구…

  • Keycloak CVE‑2026‑18963, “Password‑reset flow state validation” – 인증 없이 전면 계정 탈취 가능

    Keycloak CVE‑2026‑18963, “Password‑reset flow state validation” – 인증 없이 전면 계정 탈취 가능

    왜 지금 Keycloak에 주의가 필요한가? 기업용 솔루션 개발 회사에서 일하다 보면, 자사 솔루션 뿐만 아니라, 기간계 시스템에서 로그인을 해야 할 여러 시스템 들이 많기 때문에 이러한 계정을 하나로 통합하는 일들이 적지 않습니다. 뭐 자금력이 풍부한 기업들은 상용 SSO을 많이 사용하지만, 그렇지 않은 기업이나, 경제성을 따진다면 오픈소스로 많이 알려진 Keycloak을 쓰는 경우도 많을 것 같습니다. 그런데 최근 이 Keycloak에서…

  • Home Assistant 2026.8 릴리즈 – 접근성과 사용성을 한 차원 끌어올린 업데이트

    Home Assistant 2026.8 릴리즈 – 접근성과 사용성을 한 차원 끌어올린 업데이트

    오랜만에 Home Assistant 2026.8 버전에 대한 배포 소식을 포스트합니다. 한동안 Home Assistant를 잠시 거리를 두고 있었었는데, 최근 서버를 정비하면서 다시 관심 가지고 보고 있는 중입니다. 매달 발표되는 릴리즈를 좀 더 잘 챙겨야 겠습니다. 그럼 바로 릴리즈 소식을 정리해서 포스트 작성해봅니다. 이번 릴리즈는 “일반인들도 HA에 접근을 쉽게 한다”는 목표를 구현하기 위해 UI·UX 전반을 재정비했습니다. 약 2 개월간…

  • LiteLLM: 100개 이상의 LLM을 하나의 API로 다루는 오픈소스 AI 게이트웨이

    LiteLLM: 100개 이상의 LLM을 하나의 API로 다루는 오픈소스 AI 게이트웨이

    들어가며 요즘 서비스에 AI 기능을 넣으려면 흔히 OpenAI의 GPT, Anthropic의 Claude, Google의 Gemini, AWS Bedrock 등 여러 LLM(대규모 언어 모델) 제공업체 중 하나 이상을 선택해서 연동하게 됩니다. 문제는 이들 각각이 서로 다른 SDK, 인증 방식, 요청/응답 형식을 사용한다는 점입니다. 모델을 바꾸거나 여러 모델을 동시에 운영하려면 그만큼 코드를 다시 짜야 하죠. LiteLLM은 바로 이 문제를 해결하기…

  • AI 에이전트를 위한 프론트엔드 도구, WebMCP

    AI 에이전트를 위한 프론트엔드 도구, WebMCP

    화면 스크래핑은 끝났다 — 웹과 AI 에이전트가 대화하는 새로운 계약, WebMCP 브라우저 안에서 움직이는 AI 에이전트가 빠르게 늘고 있습니다. 사용자가 “이 항공권 예약해줘”, “이 티셔츠 장바구니에 담아줘”라고 말하면, 에이전트는 화면을 스크린샷으로 찍거나 DOM 트리를 분석해서 어떤 버튼을 누르고 어떤 칸에 무엇을 입력해야 하는지 스스로 “추측”해왔습니다. 사람이 마우스를 움직이고 키보드를 두드리는 행동을 그대로 흉내 내는 방식입니다.…

  • MCP, 상태(state)를 버리다 — 2026-07-28 스펙 변경 예고

    MCP, 상태(state)를 버리다 — 2026-07-28 스펙 변경 예고

    2026년 7월 28일, Model Context Protocol(MCP) 공식 블로그에 차세대 스펙 방향을 알리는 글이 올라왔습니다. 새 스펙 버전은 2026-07-28이며, 이번 릴리스 후보는 MCP가 출시된 이후 가장 큰 폭의 개정입니다. 핵심은 하나로 요약됩니다. “MCP를 무상태(stateless) 프로토콜로 만든다.“ 이 글에서는 MCP 블로그가 밝힌 정책 변화들을 중심으로 정리합니다. 1. 프로토콜 자체, 무상태로 변경 기존 2025-11-25 버전에서는 도구를 호출하려면 먼저…