AXONN Vantis logo
액손밴티스(주)열린 지능망 위 자율 AI 에이전트,완벽한 거버넌스
도입 상담 신청KO

Blog

최신 소식과 인사이트

MCP Gateway 기술 심층 이해와 활용

격리된 환경에서 실행되는 AI 에이전트가 외부 도구를 쓰려면 자격증명이 필요한데 그 자격증명을 격리된 환경 안에 넣는 순간 격리 자체가 무의미해진다. 본 글은 이 딜레마를 푸는 구조인 MCP 게이트웨이의 위치와 핵심 메커니즘을 살펴보고 2026년 프로토콜 차원의 최신 변화까지 함께 짚는다.

AI 모델 파라미터 활용 기법에 대한 이해

AI 모델을 파라미터 활성화 방식으로 나누면 모든 파라미터를 매번 쓰는 Dense, 일부만 골라 쓰는 MoE, 상태를 요약해 이어가는 SSM으로 갈린다. 본 글은 세 방식이 각각 어떤 문제의식에서 나왔고 어떤 환경에 가장 잘 맞는지, 기능과 성능 측면의 장단점은 무엇인지 비교한다.

쿼리에서 모듈까지 — LLM 캐스케이드 라우팅 기술의 발전사

강한 모델과 약한 모델 사이에서 무엇을 언제 고를지 정하는 캐스케이드 라우팅은 쿼리 단위 이분법에서 출발해 실행 궤적과 파이프라인 모듈 단위로 판단 기준을 넓혀 왔다. 본 글은 RouteLLM, SWE-Router, LLMSelector 세 연구를 통해 이 확장이 어떤 문제를 풀고 어떤 과제를 남겼는지 정리한다.

소프트웨어 개발 하네스를 에이전트로 구현하는 기술 동향

AI 코딩 에이전트를 실제로 움직이게 만드는 것은 모델이 아니라 그 모델을 감싼 하네스(harness)다. 본 글은 도구 연결과 피드백 루프에서 출발한 코딩 에이전트 하네스가 다중 에이전트 오케스트레이션과 격리된 실행 환경까지 아우르는 인프라 계층으로 확장되어 온 기술 동향을 정리한다.

A2A 역할과 기능에 대한 고찰

A2A(Agent-to-Agent)는 서로의 내부 구조를 들여다볼 수 없는 불투명한 에이전트 간에 작업을 위임하고 그 결과를 주고받는 절차를 표준화한 프로토콜이다. 특히 이번 v1.0 규격에서는 세 가지 통신 방식 간의 완전한 기능적 동등성을 보장하고 에이전트 카드 서명 메커니즘까지 정식 명세로 편입시켰다. 본 글은 이 명세 전체를 조망하며 프로토콜이 시스템적으로 책임지고 보장하는 영역과 그 경계선 밖에 놓여 궁극적으로 개발자(구현자)가 독자적으로 해결해야 할 과제를 명확히 구분해 내는 데 목적이 있다.

LLM Adapter의 정의와 기술적 고려사항

LLM Adapter는 프로바이더 API를 감싸는 얇은 래퍼가 아니라 성공 경로의 자료구조와 함께 실패 의미론, 스트리밍 의미론, 왕복 불변식까지 정규화하는 구성 요소이다. OpenAI와 Anthropic, Google의 상용 API와 vLLM 기반 자체 호스팅 모델을 하나의 계층 뒤에 두려 할 때 실제로 문제가 되는 지점들을 정의에서 시작해 아키텍처와 검증 방법까지 정리한다.

SLM 환경에서 In-schema Chain-of-Thought(CoT) 활용

온프레미스 SLM으로 앱의 헬퍼 에이전트를 구현할 때 하이브리드 추론 모델의 `<think>` 구간과 GBNF/JSON 제약 디코딩은 같은 토큰 스트림의 통제권을 두고 충돌한다. Qwen3 1.7B를 사용한 PropTech 자동화 프로젝트에서 이 충돌의 구조적 원인을 규명하고, 사고 과정을 스키마 내부로 이전하는 In-schema CoT를 통해 System 2의 효용과 출력 안정성을 동시에 확보한 설계를 정리한다.

MicroVM 복원 지연의 숨은 주범 — ARP Stall 현상과 예방 설계

밀리초 단위의 스케일링이 요구되는 MicroVM 환경에서 AI 에이전트 스냅샷 복원 시 발생하는 1초 내외의 치명적인 지연은 종종 네트워크 커널의 ARP Stall 현상에서 기인한다. 이를 원천적으로 방지하기 위해 복원 시점에 호스트의 이웃 항목(Neighbor Entry)을 사전에 주입하는 ARP Priming 아키텍처 설계를 통해 네트워크 대기 시간을 870ms에서 1.8ms로 단축하는 설계 인사이트를 제시한다.

© 2026 AXONN Vantis Inc. All rights reserved.