MatchDay AI 구축하기: 이벤트 여행을 위한 메모리 인식 오토파일럿
저는 Qwen Cloud Global AI 및 OpenAI Build Week 해커톤을 위해 MatchDay AI를 구축했으며, 트랙 4: 오토파일럿 에이전트에만 제출했습니다. 지속적인 메모리 기능은 트랙 1에도 부합하지만, 이는 두 번째 트랙 참가가 아닌 하나의 트랙 4 제출물 내 차별화 요소입니다. 핵심 혁신은 완전한 워크플로우입니다: 복잡한 요청을 이해하고, 관련 선호도를 기억하며, 타입화된 도구를 호출하고, 여행을 방해하는 충돌을 감지하며, 계획을 수정하고, 결과를 독립적으로 검증합니다.
[아키텍처 보기]

아키텍처

아키텍처-프론트엔드

아키텍처-메모리

아키텍처-오토파일럿
문제와 그 가치
여행 검색은 신뢰할 수 있는 여행 계획과 동일하지 않습니다. 항공편이 저렴해 보여도 공항 이동 시간과 팬의 안전 버퍼를 적용하면 너무 늦게 도착할 수 있습니다. 익숙한 선호도가 세션 사이에서 사라질 수 있습니다. 오래된 판매자 링크가 결과가 0개로 반환될 수 있습니다. 경로 추정이 요금으로 오인되거나, 불완전한 제공업체 데이터가 부당한 예약 주장이 될 수 있습니다.
고위험 이벤트의 경우, 이는 단순한 외관상의 실패가 아닙니다: 잘못된 추천 하나가 전체 여행을 무가치하게 만들 수 있습니다. MatchDay는 이를 계획을 완료로 표시하기 전에 명시적 제약 조건, 증거 상태, 그리고 검증 확인으로 전환합니다.
MatchDay 작동 방식
프로덕션 경로는 다음과 같습니다:
1팬 → Vercel의 Next.js → 서명된 서버 퍼사드 → Alibaba ECS23→ Caddy + FastAPI + PostgreSQL + 지속적인 워커45→ Qwen Cloud + 타입화된 여행/컨텍스트 도구67→ 정규화 → 순위 지정 → 충돌 감지 → 수리 → 검증89→ 변경 불가능한 여행 버전 및 프라이버시 안전 공유
Qwen Cloud의 qwen3.7-plus는 프로덕션 계획 컨트롤러입니다. 자연어를 해석하고, 각 턴을 분류하며, 모호성을 해결하고, 타입화된 도구를 선택하며, 근거 있는 메모리 변경을 제안하고, 허용된 수리 후보에서 선택하며, 결과를 설명합니다. 바운드된 게이트웨이는 qwen.py에 구현되어 있으며, 지속적인 도구 루프는 agent.py에 있습니다.
모델은 자신의 답변을 인증하지 않습니다. 결정적 코드는 스키마, 픽스처 바인딩, 증거 검증, 패키지 산술, 제약 조건 적용, 충돌 감지, 수리 적용, 그리고 safety.py의 독립적인 14개 검사 릴리스 계약을 소유합니다. 이것이 가장 중요한 아키텍처 결정이었습니다: 판단에는 모델을 사용하지만, 진실에는 코드를 사용하라.
지속적 메모리도 동일한 원칙을 따릅니다. 명시적 사용자 사실과 반복되는 검증된 행동은 하나의 소유자 범위 단일 진실 공급원으로 들어가지만, 한 번의 특이한 여행이 조용히 영구적 선호도가 되지는 않습니다. 행동은 뚜렷한 루트 여행에 걸쳐 강화된 후에만 승격됩니다. 메모리는 memory.py에서 바운드된 리콜, 여행별 네임스페이스, 현재 메시지 우선 순위, 수정, 만료, 대체, 삭제, 비활성화 및 감사 가능한 재사용을 지원합니다.
자율성은 지속적이지만 무제한적이지는 않습니다. PostgreSQL 임대, 펜싱 토큰, 체크포인트, 재시도, 취소, 멱등성, 그리고 누적 시간/모델/도구/비용 제한은 중단된 작업이 영원히 실행되거나 동일한 예산을 두 번 소비하지 않고 재개할 수 있도록 합니다. 런타임은 runs.py에 있으며, Alibaba 배포는 docker-compose.yml에서 별도의 API, run-worker, 픽스처-갱신, PostgreSQL 및 Caddy 서비스를 시작합니다.
Codex가 작업을 가속화한 부분
Qwen은 MatchDay의 런타임 지능입니다. GPT-5.6 Sol Max 구성을 사용한 Codex는 제 엔지니어링 가속기였습니다. 저는 작고 독립적으로 검증 가능한 조각에 대해 OpenClaw의 Peter 스타일 루프(정의, 구축, 공격, 확인, 수정)의 바운드된 하이브리드 버전을 사용했습니다.
Codex는 아키텍처 추적, 구현, 회귀 테스트 생성, 근본 원인 분석, 적대적 검토, 브라우저 QA 및 배포 검증을 가속화했습니다. 이는 해피패스 데모가 놓칠 수 있는 문제를 드러내는 데 도움이 되었습니다: 수동 편집 후 메모리 단일 진실 공급원 불일치, 잘못된 교차 세션 리콜, 오래되었거나 결과가 0개인 항공편 핸드오프, 프롬프트 및 간접 인젝션, SSRF 및 안전하지 않은 리디렉션, 재생 공격, 테넌트 격리, 동시성 경쟁, 오래된 체크포인트, 그리고 저하된 지도 또는 3D 렌더링.
핵심 제품 결정은 명시적으로 유지되었습니다: 저는 Qwen 대 결정적 신뢰 경계, 2회 여행 메모리 승격 임계값, 증거 분류 체계, 지원되지 않거나 고위험 주장에 대한 인간 체크포인트, 그리고 구매 금지 릴리스 경계를 선택했습니다. Codex는 피드백 주기를 단축하고 각 주장을 공격했습니다; 제품 및 안전 결정을 대체하지는 않았습니다.
심사 기준과의 매핑
- 혁신성 및 AI 창의성: MatchDay는 교차 세션 메모리, 지속적인 오토파일럿, 증거 기반 수리 및 독립적 검증기를 결합합니다.
기억됨 → 충돌 감지됨 → 계획 수리됨 → 결과 검증됨이라는 가시적인 레일은 해당 아키텍처를 채팅 응답 뒤에 숨기지 않고 검사 가능하게 만듭니다.
- 기술적 깊이 및 엔지니어링: Qwen Cloud는 타입화된 결정을 구동합니다; Alibaba ECS는 FastAPI/PostgreSQL 제어 및 실행 평면을 실행합니다; Vercel은 서명된 프론트엔드 경계를 제공합니다. 저장소는 소스 블라인드 평가, 제공업체 계약 테스트, PostgreSQL 동시성 검사 및 Chromium, Firefox, WebKit에서의 Playwright 여정을 포함합니다.
- 문제 가치 및 영향: 현재 B2C 제품은 비싸고 시간에 민감한 이벤트 여행을 계획하는 팬을 보호합니다. 미래의 B2B 경로는 자체 인벤토리, 정책, 승인 규칙 및 고객 채널을 사용하는 여행사를 위한 임베드 가능 또는 화이트 라벨 계획 에이전트입니다. AGPL-3.0 제공업체 아키텍처는 오픈소스 채택도 지원합니다.
- 프레젠테이션 및 문서화: 심사위원은 자격 증명 없이 라이브 앱을 사용해 보고, 사실적 결정 추적을 검사하며, 명시적 증거 경계가 있는 지도와 예시 스타디움 렌즈를 사용하고, 짧은 데모를 시청하며, 모든 아키텍처 다이어그램을 Graphviz 소스에서 다시 생성할 수 있습니다.
MatchDay는 현재 월드컵 여행 계획에 초점을 맞추고 있으며 여행을 구매하지 않습니다. 라이브 상업적 증거는 구성된 제공업체 액세스에 따라 달라집니다; 누락된 가격, 인벤토리, 가용성 또는 환불 조건은 눈에 띄게 알 수 없음으로 유지됩니다. 더 넓은 이벤트 여행 및 에이전시 임베딩은 제품 방향이며, 현재 릴리스에 대한 주장이 아닙니다.
목표는 간단합니다: 자율 여행 에이전트는 단순히 답변을 생성해서는 안 됩니다—책임감 있게 기억하고, 증거 내에서 행동하며, 안전하지 않은 것을 수리하고, 최종 계획을 증명해야 합니다. #QWEN #ALIBABA #CODEX #OPENAI #HACKATHON #CLOUD

![[메모] 성과가 낮은 부하 직원을 배제하는 상사들](https://youmind.club/__ym/cms-assets/media/1784827522698_408j7z_HN3Kb76awAAvvjF.jpg)



