AI 에이전트의 ‘자신만만한 거짓’: 문제는 모델이 아니라 맥락
기업용 AI 도입이 급속도로 확산되면서 업계는 새로운 위험에 직면하고 있습니다. 환각(Hallucination) 현상을 넘어, AI 에이전트가 높은 신뢰도로 잘못된 답변을 제공하는 문제가 대두되고 있는 것입니다. 흥미로운 점은 이 현상의 원인이 거대언어모델(LLM)의…
ChatGPT · Claude · 한국 AI
기업용 AI 도입이 급속도로 확산되면서 업계는 새로운 위험에 직면하고 있습니다. 환각(Hallucination) 현상을 넘어, AI 에이전트가 높은 신뢰도로 잘못된 답변을 제공하는 문제가 대두되고 있는 것입니다. 흥미로운 점은 이 현상의 원인이 거대언어모델(LLM)의…
마이크로소프트가 ‘Microsoft Build 2026’에서 공개한 ‘Surface RTX Spark Dev Box’는 단순한 신형 워크스테이션 출시를 넘어 AI 경제 패러다임을 전환하는 기기입니다. 그간 개발자들은 클라우드 API를 통해 사용한 토큰(Token)만큼 비용을 지불해왔습니다. 하지만…
[핵심 요약] AI 기술이 단순 대화형 챗봇을 넘어 스스로 업무를 수행하는 에이전틱 AI로 빠르게 진화하고 있습니다. 하지만 기업들이 마주한 진짜 위험은 AI 모델의 지능이 아니라, 이 에이전트들이 실제 환경에서 작동할…
[핵심 요약] 구글이 ‘Phone by Google’ 앱에 AI 기반의 지인 사칭 전화 탐지 기능을 추가합니다. 이는 단순한 스팸 차단을 넘어 내 연락처에 등록된 번호로 표시되더라도 실제 발신자가 사기꾼일 경우를 감지해…
2026년 6월 현재, 미국 트럼프 행정부가 추진 중인 AI 모델 사전 검증 제도가 한국의 기업용 AI 도입 환경을 크게 흔들고 있습니다. OpenAI, 구글, 앤스로픽 등 주요 AI 서비스의 공급 체계가…
인공지능(AI)의 역할이 텍스트 요약이나 코드 작성을 넘어 국가 기반시설의 보안을 책임지는 단계로 빠르게 진화하고 있습니다. 앤스로픽이 보안 취약점 점검 프로그램 ‘프로젝트 글래스윙(Project Glasswing)’과 보안 특화 모델 ‘클로드 미토스(Claude Mythos)’의 접근…
마이크로소프트가 최근 공개한 오픈소스 프레임워크 ‘Adaptive Spec-driven Scoring for Evaluation and Regression Testing’은 AI 모델 검증 방식을 근본적으로 바꾸고 있습니다. 개발자가 자연어로 작성한 스펙만으로 AI의 동작을 테스트하고, 업데이트 후 성능…
최근 글로벌 기상 예측 시장에서 전통적 정부 기관의 모델을 능가하는 AI 스타트업이 주목받고 있습니다. 윈드본(WindBorn)이 그 주인공입니다. 단순히 기존 기상 데이터를 학습하는 수준을 벗어나, 전 세계 15개 지점에서 400여 개의…
엔비디아가 소비자용 노트북 칩셋 ‘RTX Spark’를 출시하며 AI 컴퓨팅 환경을 근본적으로 변화시키고 있습니다. 마이크로소프트, ASUS, HP, Dell 등 글로벌 제조사들이 올가을부터 RTX Spark 탑재 신제품을 출시할 예정이며, 이는 단순한 성능…
그래픽 카드 제조사로 알려진 엔비디아(NVIDIA)가 이제 PC의 중앙처리장치(CPU) 시장에 본격적으로 진출합니다. 최근 발표한 ‘RTX Spark’는 단순한 그래픽 처리 칩을 넘어 인텔이나 애플의 실리콘처럼 PC의 전체 연산 능력을 재정의하는 통합 칩입니다.…