← 탐색

태그된 포스트: 에이전트

AI 실무 적용기 · ·3분 읽기

함수는 맞게 골랐는데 인자가 환각이었다

사내 CS 에이전트에 function calling을 붙인 지 3주째, 정확도 리포트는 꾸준히 97%를 찍고 있었다. 그런데 특정 고객의 환불 건이 이상했다.

function-callingtool-use에이전트
AI 레이더 · ·2분 읽기

K3가 48시간 만에 칩을 설계했고, Cadence 주가가 9% 빠졌다

Moonshot AI가 Kimi K3에게 칩 하나를 설계하라고 시켰다. RTL 작성부터 합성, 배치배선, 타이밍 검증, 시뮬레이션까지 — 48시간, 사람 개입 제로.

kimi-k3칩-설계eda
AI 레이더 · ·3분 읽기

취약점 하나 잡는 데 AI 모델 세 개가 필요한 이유

Anthropic이 Mythos로 7주 만에 제로데이 2,000개를 찾아냈을 때, 보안 업계는 둘로 갈렸다. "게임 체인저다"와 "접근 통제 안 하면 끝장이다.

project-perceptionmicrosoftai-보안
AI 실무 적용기 · ·3분 읽기

에이전트에게 기억을 달아줬더니 거짓 기억부터 만들었다

고객 지원 에이전트에 세션 간 기억 기능을 붙인 지 3주째, CS 티켓이 하나 올라왔다. "이 봇이 제가 서울에 산다고 하는데, 저 작년에 부산으로 이사했거든요.

에이전트메모리상태관리
AI 실무 적용기 · ·3분 읽기

검색 한 번이면 될 걸 에이전트가 다섯 번 검색했다

내부 문서 검색 챗봇의 정확도가 70%에서 안 올라갔다. 임베딩도 바꿔보고 청킹 전략도 손봤는데, 진짜 병목은 다른 데 있었다 — 복합 질문에서 한 번의 검색으로 답이 안 나오는 구조적 한계.

에이전틱ragrag에이전트
디자인 시스템 로그 · ·3분 읽기

에이전트는 토큰을 읽는다. 브랜드는 못 읽는다.

GPT-5.6이 Figma Make에 올라탄 7월 9일, 디자인 커뮤니티에서 가장 많이 돈 말은 "프로토타이핑 5분 컷"이었다.

디자인시스템에이전트브랜드컨텍스트
AI 실무 적용기 · ·3분 읽기

에이전트 하나짜리 아키텍처가 세 번째 장애에서 무너졌다

에이전트 하나가 고객 응대, 데이터 조회, 결제 처리를 전부 맡고 있었다. PoC에서는 완벽했고, 데모 영상도 찍었고, C레벨도 박수쳤다.

에이전트아키텍처모놀리스
AI 레이더 · ·3분 읽기

GPT-5.6, 벤치마크 말고 지갑으로 골라라

OpenAI가 GPT-5.6을 내놓으면서 전례 없는 실험을 했다.

gpt-5-6openaisol
AI 레이더 · ·3분 읽기

기억하는 AI는 안 된다 — 중국 의인화 규제, 내일 시행

내일(7월 15일), 중국에서 가장 많이 쓰이는 AI 앱 두바오(豆包)의 에이전트 기능이 완전히 꺼진다. 월간 활성 사용자 3억 4,500만 명짜리 앱이다.

중국-ai-규제의인화두바오
AI 레이더 · ·2분 읽기

ChatGPT가 슈퍼앱이 됐다 — Codex 흡수하고 Work 출시한 OpenAI의 다음 수

어제 OpenAI가 ChatGPT 데스크톱 앱을 완전히 뜯어고쳤다. Chat, Work, Codex — 세 개가 하나의 앱에 들어갔다.

chatgpt-workopenaicodex
AI 레이더 · ·3분 읽기

Grok 4.5 — 토큰은 4배 아끼는데 Opus급이라 불러도 되나

SpaceXAI가 Cursor를 $60B에 인수하고 나서 첫 번째 모델을 내놨다. Grok 4.

grok-4-5spacexaicursor
AI 레이더 · ·3분 읽기

GPT-5.6 풀렸다 — 가격표보다 시스템 카드가 더 뜨겁다

GPT-5.6이 오늘 드디어 API에 풀렸다.

gpt-5-6openai시스템-카드
AI 실무 적용기 · ·3분 읽기

에이전트에게 도구를 40개 줬더니 대화를 까먹기 시작했다

지난달 사내 CS 에이전트에 MCP 서버를 하나 더 붙였다. Jira 연동.

mcp컨텍스트윈도우에이전트
AI 레이더 · ·3분 읽기

토큰 단가 50배 하락, AI 청구서 3배 상승 — 에이전트가 다 먹었다

토큰 단가가 매년 50배씩 떨어지고 있다는 뉴스가 거의 매주 나온다. GPT-4급 성능을 뽑아내는 비용이 2022년 대비 1000분의 1 수준이라니, 좋은 시대가 온 것 같다.

토큰-비용에이전트추론-비용
AI 실무 적용기 · ·2분 읽기

QA 통과율 99%짜리 가드레일이 프로덕션 1주차에 뚫렸다

QA 팀이 정성들여 만든 프롬프트 300개로 레드팀 테스트를 돌렸다. 차단율 99%.

가드레일프로덕션프롬프트인젝션
AI 레이더 · ·3분 읽기

에이전트 인프라를 직접 짜는 시대가 끝났다 — Google Managed Agents

에이전트 만든다고 LangChain 붙이고, Docker 샌드박스 구성하고, 상태 관리 로직 짜고, 도구 실행 파이프라인 만들고. 이 삽질의 80%가 API 한 줄로 대체되는 세상이 왔다.

googlegemini-apimanaged-agents
AI 레이더 · ·2분 읽기

Build 2026: 마이크로소프트가 Windows에 에이전트 런타임을 심었다

오늘 새벽 사티아 나델라가 샌프란시스코 포트 메이슨 센터에서 Build 2026 키노트를 열었다. 3년 만에 시애틀 밖에서 여는 Build인데, 핵심 메시지는 하나로 요약된다 — Windows를 에이전트 플랫폼으로 재정의하겠다는 선언이다.

microsoft-build-2026windows-agent-frameworkfoundry-local
AI 레이더 · ·3분 읽기

코드 10만 줄 마이그레이션, 프롬프트 한 줄로 끝내는 시대

Anthropic이 5월 28일 Opus 4.8을 출시하면서 같이 내놓은 게 하나 있다.

anthropicopus-4-8dynamic-workflows
AI 실무 적용기 · ·3분 읽기

Tool Calling의 90%는 LLM이 아니라 배관 공사다

프로덕션에 올린 에이전트가 밤새 47,000달러어치 API 호출을 했다는 사후 보고서를 읽었다. 분석 에이전트와 검증 에이전트가 서로에게 피드백을 주고받는 루프에 빠졌는데, 기술적으로는 '정상 동작'이었다.

tool-callingfunction-calling프로덕션
AI 레이더 · ·2분 읽기

375k 스타의 랍스터 — OpenClaw가 React를 넘은 진짜 이유

React를 GitHub 스타 수에서 추월하는 프로젝트가 나올 줄은 솔직히 몰랐다. OpenClaw는 지금 375,000개를 넘겼다.

openclawgithubself-hosted
1 / 3 Next →