[카테고리:] AI

  • LiteLLM: 100개 이상의 LLM을 하나의 API로 다루는 오픈소스 AI 게이트웨이

    LiteLLM: 100개 이상의 LLM을 하나의 API로 다루는 오픈소스 AI 게이트웨이

    들어가며 요즘 서비스에 AI 기능을 넣으려면 흔히 OpenAI의 GPT, Anthropic의 Claude, Google의 Gemini, AWS Bedrock 등 여러 LLM(대규모 언어 모델) 제공업체 중 하나 이상을 선택해서 연동하게 됩니다. 문제는 이들 각각이 서로 다른 SDK, 인증 방식, 요청/응답 형식을 사용한다는 점입니다. 모델을 바꾸거나 여러 모델을 동시에 운영하려면 그만큼 코드를 다시 짜야 하죠. LiteLLM은 바로 이 문제를 해결하기…

  • AI 에이전트를 위한 프론트엔드 도구, WebMCP

    AI 에이전트를 위한 프론트엔드 도구, WebMCP

    화면 스크래핑은 끝났다 — 웹과 AI 에이전트가 대화하는 새로운 계약, WebMCP 브라우저 안에서 움직이는 AI 에이전트가 빠르게 늘고 있습니다. 사용자가 “이 항공권 예약해줘”, “이 티셔츠 장바구니에 담아줘”라고 말하면, 에이전트는 화면을 스크린샷으로 찍거나 DOM 트리를 분석해서 어떤 버튼을 누르고 어떤 칸에 무엇을 입력해야 하는지 스스로 “추측”해왔습니다. 사람이 마우스를 움직이고 키보드를 두드리는 행동을 그대로 흉내 내는 방식입니다.…

  • MCP, 상태(state)를 버리다 — 2026-07-28 스펙 변경 예고

    MCP, 상태(state)를 버리다 — 2026-07-28 스펙 변경 예고

    2026년 7월 28일, Model Context Protocol(MCP) 공식 블로그에 차세대 스펙 방향을 알리는 글이 올라왔습니다. 새 스펙 버전은 2026-07-28이며, 이번 릴리스 후보는 MCP가 출시된 이후 가장 큰 폭의 개정입니다. 핵심은 하나로 요약됩니다. “MCP를 무상태(stateless) 프로토콜로 만든다.“ 이 글에서는 MCP 블로그가 밝힌 정책 변화들을 중심으로 정리합니다. 1. 프로토콜 자체, 무상태로 변경 기존 2025-11-25 버전에서는 도구를 호출하려면 먼저…

  • AI 에이전트를 제대로 활용하기: AI Orchestration으로 워크플로우 설계

    AI 에이전트를 제대로 활용하기: AI Orchestration으로 워크플로우 설계

    혼자서도 코드를 짜고, 버그를 찾고, 리서치 보고서를 쓰는 AI 에이전트가 이제는 매우 일반적인 흐름이 되었습니다. 문제는 그 다음입니다. “에이전트 하나가 잘한다면, 여러 개를 붙이면 몇 배는 더 잘하지 않을까?”라는 자연스러운 기대에서 AI Orchestration이라는 영역이 태어났습니다. 오늘 포스트에서는 AI Orchestration이 무엇인지, 어떤 기능이 핵심인지, 어떤 도구와 상용 플랫폼이 있는지, 그리고 앞으로 전망을 조심스럽게 예측해봅니다. 1. AI…

  • AI 에이전트, 기업 사용에서 두 배로 늘었지만 여전히 ‘인간의 감독’ 아래

    AI 에이전트, 기업 사용에서 두 배로 늘었지만 여전히 ‘인간의 감독’ 아래

    2026년 5월, Stack Overflow의 최신 펄스 서베이(Pulse Survey) 결과가 공개되었습니다. 이번 조사에는 약 1,100명의 개발자 및 직장인이 참여했으며, AI 에이전트의 업무 활용 현황에 대한 흥미로운 인사이트를 담고 있습니다. 핵심 메시지는 단 하나입니다. “AI 에이전트 사용은 폭발적으로 늘었지만, 완전한 자율 운영은 아직 이다”라는 것입니다. AI 에이전트 사용률, 1년 만에 두 배 가까이 급증 가장 눈에 띄는…

  • Gemma 4 12B 공개 — 인코더 없이 노트북에서 구동되는 통합 멀티모달 AI

    Gemma 4 12B 공개 — 인코더 없이 노트북에서 구동되는 통합 멀티모달 AI

    들어가며 2026년 4월 3일, Google DeepMind는 Gemma 4 라인업을 공개했습니다. 모바일 엣지용 E2B·E4B부터 대규모 서버급 31B Dense와 26B MoE 모델까지, 다양한 환경을 커버하는 포트폴리오였습니다. 그리고 그로부터 약 두 달 뒤인 2026년 6월 3일, 그 라인업의 빈칸을 채우는 중간 라인업 Gemma 4 12B가 등장했습니다. 이 모델은 단순히 “중간 크기”를 채우는 데 그치지 않습니다. 인코더 없는(Encoder-free) 통합…

  • 드디어 온 미래: AI 시대, 일자리가 위협되는 시대가 왔는가?

    드디어 온 미래: AI 시대, 일자리가 위협되는 시대가 왔는가?

    그날의 미팅 최근 업무 미팅에서 나는 숨죽여 프레젠테이션을 지켜봤다. 후발 주자인 경쟁사를 따라잡기 위한 전략을 논의하는 자리였다. 화면에 띄워진 제안서의 핵심은 명확했다: 인원 감축과 AI 기반 자동화 시스템 도입. “AI 에이전트가 세 명의 업무를 처리할 수 있습니다.” “조직을 평탄화하고 매니저 레이어를 줄입니다.” “비용 절감과 동시에 생산성을 극대화할 수 있습니다.” 회의실의 공기가 묵직했다. 누군가는 고개를 끄덕였고,…

  • 데이터 스키마를 넘어 지식 모델로: 온톨로지와 엔터프라이즈 AI의 미래

    데이터 스키마를 넘어 지식 모델로: 온톨로지와 엔터프라이즈 AI의 미래

    오랜만에 포스팅입니다. 그 동안 예상치 못한 업무들로 정신이 없었던 것 같습니다. 잠시 숨고르고 최근 프로젝트에서 자주 학습하고 있는 온톨로지에 대해서 정리하는 차원에서 포스트로 다뤄봤습니다. 처음 개념을 접하시는 분들에게 도움이 되었으면 합니다. 온톨로지란 무엇인가? 철학에서 온톨로지는 “존재론”입니다.무엇이 존재하는지, 그것들이 어떤 관계를 맺는지에 대한 이론이죠. IT/데이터 세계에서의 온톨로지(Ontology) 는 이를 차용해: “어떤 도메인(분야)에 존재하는 개념(Things)과 그들 사이의 관계(Relations)를명시적으로, 일관되게,…

  • 2028 글로벌 인텔리전스 위기 (The 2028 Global Intelligence Crisis)

    2028 글로벌 인텔리전스 위기 (The 2028 Global Intelligence Crisis)

    시트리니 리서치(Citrini Research) 보고서 심층 분석 — AI의 성공이 경제를 무너뜨리는 역설 AI에 대한 낙관론이 정점을 찍던 2026년 2월, 월가의 유명 리서치 기관 시트리니 리서치가 충격적인 보고서를 발표했습니다. “AI 강세론이 계속 옳다면 — 그것이 오히려 약세 신호가 될 수 있다면?” 이 역설적인 질문에서 출발한 보고서는 미국 증시를 요동치게 만들었고, AI 반도체부터 부동산·노동시장까지 전 분야에 경고음을…