알리바바 클라우드 Qwen 컨퍼런스 2026 싱가포르 키노트 요약

싱가포르에서 처음 열린 Qwen 컨퍼런스의 키노트에서 알리바바 클라우드가 '에이전틱 AI 시대'로의 전환을 공식화했다. 싱가포르 정부, 알리바바 클라우드 경영진, Nous Research, Fireworks AI, NVIDIA, PicsArt 등 파트너사 인사들이 무대에 올라 모델, 인프라, 도구, 생태계 전반에 걸친 변화를 쏟아냈다. 핵심 메시지는 '토큰을 지능으로, 지능을 행동으로, 행동을 비즈니스 가치로' 전환하는 풀스택 인프라를 만들겠다는 것이었다.
싱가포르 정부 협력
Desmond Tan 싱가포르 국무장관은 알리바바 클라우드, NTUC, ST텔레미디어 데이터센터와 함께 1,000개 이상 현지 기업과 개발자, 학생에게 생성형 AI와 에이전틱 AI 실무 교육을 제공하는 협력안을 발표했다. 'AI는 노동자를 대체하지 않고 노동자를 위해 일한다'는 원칙을 강조하며, AI 교육 확산을 통한 디지털 경쟁력 강화에 나섰다.
Qwen 3.7 Max 공개
이번 행사에서 가장 주목받은 발표는 신형 파운데이션 모델 Qwen 3.7 Max였다. 코딩능력, 도구 사용(MCP 프로토콜 기본 지원), 멀티모달, 장기 실행(long-horizon) 작업능력을 대폭 강화했다. SWE-Bench, IFBench, HLE 등 주요 벤치마크에서 최상위권 성능을 기록했다고 밝혔다. 에이전트 워크로드에 특화되어, 35시간 연속 실행에서 1,000회 이상 도구 호출, 평균 10배 속도 향상을 달성한 사례도 공개했다.
Qwen Cloud 에이전트 전용 게이트웨이
알리바바 클라우드는 qwencloud.com이라는 에이전트 전용 게이트웨이도 출시했다. 200개 이상 모델을 지원하며, 토큰 요금제(월 30달러 스탠다드부터 맥스 플랜까지)를 제공한다. Skills와 CLI 기반 워크플로우 자동화 공능까지 갖추고 있어, 개발자가 에이전트 파이프라인을 빠르게 구축할 수 있다.
Coder와 Muron
알리바바는 노트북에 설치되는 바이브 코딩 도구 Coder와 클라우드에서 24시간 작동하는 멀티 도메인 에이전트 Muron도 선보였다. Muron은 이미 43개국에서 활용 중이며, 알리바바 내부에서도 5명이 7일 만에 Coder Works를 자체 구축했다. Coder는 모델 자동 선택 기능으로 토큰 비용을 최대 70%까지 절감할 수 있다고 밝혔다.
에이전틱 클라우드 인프라
에이전틱 클라우드 인프라도 공개됐다. MicroVM 기반 샌드박스는 밀리초 단위 부팅과 테넌트당 1만 동시 세션을 지원한다. 에이전트 ID와 거버넌스, 보안, 메모리, 데이터 플레인을 망라하는 풀스택 구조다. MiniMax는 이 인프라 위에서 20~40ms 컨테이너 부팅과 40% TCO 절감을 달성했다고보고했다.
기술적 차별점
알리바바 클라우드의 기술적 차별점은 자체 실리콘(PPU, 5세대 CIPU)에서 파운데이션 모델까지 모든 계층을 자체 보유한 하이퍼스케일러라는 점이다. 에이전트 네이티브 클라우드 구조로, 사람이 쓰던 SaaS 중심에서 에이전트가 직접 호출하는 API와 인프라로 컨트롤 플레인을 재설계하고 있다.
오픈 생태계도 활발하다. PyTorch재단 플래티넘 멤버로 합류했고, Kimi, Zhipu, MiniMax, StepFun, Vidu 등 경쟁 모델사까지 모델 스튜디오에 입점시켜 멀티모델 허브를 지향한다. 누적 다운로드 20억 건, 450개 이상 오픈소스 모델을 보유하고 있다.
신뢰 구축의 과제
축제 분위기만 있는 것은 아니다. Nous Research의 Tommy Eastman은 동일 작업을 재현 가능하게 수행하는 것이 여전히 큰 숙제라며, 모델 품질과 휴먼 인 더 루프, 에이전트 간 거버넌스라는 3단계 접근이 필요하다고 지적했다. Fireworks AI는 추론의 가장 큰 병목이 연산이 아닌 KV 캐시 메모리라며, 멀티 계층 스토리지와 시스템적 재설계가 필요하다고 진단했다.
NVIDIA는 에이전트의 직렬적 도구 호출 특성상 단일 스레드 성능이 빠른 새로운 CPU 수요가 폭증할 것이라며, 기존 클라우드 CPU 설계 전제가 흔들리고 있다고 짚었다.

생태계 사례
PicsArt는 1억 3,000만 사용자 기반에 Qwen Image, Wan, Happy Horse 모델을 통합해 페르소나 캐스팅과 영상 광고 제작 같은 에이전트형 워크플로우를 시연했다. Happy Horse 도입 후 영상 생성량이 72% 증가했다고 밝혔다.
상금 7만 달러 규모의 Qwen Cloud Global Hackathon과 Happy Horse Awards 2026도 함께 발표되며 개발자와 창작자 유입을 노렸다.
구글 클라우드와 비교
한 달 앞서 열린 구글 Cloud Next 2025와 I/O 2025도 사실상 같은 방향을 가리켰지만 무기는 달랐다. 구글은 Gemini 2.5 Pro Deep Think, Agent Development Kit, Agent2Agent(A2A) 프로토콜, 7세대 TPU Ironwood까지 검색과 디바이스, 인프라를 아우르는 발표를 쏟아냈다. 구글의 AI Mode가 200개국 1억 5,000만 명, Gemini 앱이 월 4억 명에 도달했고, 토큰 처리량이 1년 만에 9조 7,000억에서 480조로 50배 늘었다.
알리바바가 풀스택 수직 통합과 오픈소스, 경쟁사 모델 입점이라는 허브 전략을 추구한다면, 구글은 압도적 사용자 접점과 자체 TPU, A2A 표준 선점으로 맞섰다. 각자의 약점도 있다. 구글은 주력 Gemini를 클로즈드로 유지하고 많은 발표가 아직 'coming soon' 상태이며, 알리바바는 미국과 유럽 시장 접근성과 신뢰성 과제를 안고 있다.
핵심 정리
에이전틱 AI 시대의 전환점이 열린 이번 컨퍼런스에서 알리바바 클라우드는 실리콘부터 모델, 인프라, 도구, 생태계까지 수직으로 묶는 동시에 PyTorch와 경쟁 모델사까지 끌어안는 수평적 확장을 동시에 추진하고 있다. 다만 신뢰성, 메모리 병목, CPU 아키텍처 재설계 같은 근본 과제가 패널 토론에서 반복적으로 거론된 만큼, 에이전틱 클라우드가 실제 엔터프라이즈 워크로드에서 약속한 성능과 경제성을 입증하는 것은 앞으로의 과제로 남아 있다.
싱가포르를 국제 사업 거점으로 삼아 미국 하이퍼스케일러들과의 경쟁 구도를 본격화하려는 알리바바의 의도가 이번 행사 전반에서 뚜렷하게 드러났다.
📚 출처
• GeekNews - 알리바바 클라우드 Qwen 컨퍼런스 2026 싱가포르 키노트 요약
• Alibaba Cloud Community - Qwen Conference 2026: A First Look at the Exhibition Highlights
• Alibaba Cloud LinkedIn - Qwen Conference 2026
📚 출처
'AI 뉴스' 카테고리의 다른 글
| 기술 CEO들은 AI 정신증을 겪고 있는 듯하다 (0) | 2026.05.29 |
|---|---|
| Show GN: AI Skill Store — AI 에이전트가 직접 스킬을 찾고 설치하는 마켓플레이스 (0) | 2026.05.29 |
| Show GN: 노트북 덮어도 안 죽는 Claude CLI 멀티세션 웹 터미널 (0) | 2026.05.28 |
| AI와 대화하는 데 지쳤어요 — 프록시 없는 대화를 향해서 (0) | 2026.05.28 |
| 개발자들이 실제로 좋아하는 도구 2026 — Lobsters 커뮤니티의 생생한 의견 (0) | 2026.05.28 |