WeChat의 샤오웨이 에이전트는 비밀리에 617B MoE로 구동된다 - 텐센트의 조용한 Frontier 베팅

진행 중인 이슈 : Économie de l'open frontier : viabilité, subvention, pivots· 편 19/20

모델 & 도구 Aug 13, 2026 at 12:579북마크에 추가

WeChat의 샤오웨이 에이전트는 비밀리에 617B MoE로 구동된다 - 텐센트의 조용한 Frontier 베팅
삽화 : Léa Fontaine

WeLM, 위챗의 AI 에이전트를 구동하는 모델은 617억 개의 매개변수로 조용히 확장되었으며, 공개되지 않은 디코딩 메커니즘을 갖추고 있습니다. 벤치마크도, 논문도 없습니다. 단지 수십억 명의 사용자 배포만이 있을 뿐입니다.

간단히 말해:

텐센트의 샤오웨이 에이전트는 위챗 내부에서 그레이 테스트 중이며, 희소 혼합 전문가 모델인 WeLM에서 구동됩니다. WeLM은 조용히 6,170억 개의 매개변수로 성장했지만, 공개 벤치마크도, 논문도 없습니다. 세계에서 가장 트래픽이 많은 메시징 플랫폼 중 하나에서 대규모 그레이 테스트가 진행 중일 뿐입니다.

사실

판데일리(Pandaily)의 보도에 따르면, 위챗 AI 팀은 WeLM의 희소 MoE 버전이 6,170억 개의 매개변수에 도달했으며, 각 토큰당 230억 개의 매개변수를 활성화한다고 밝혔습니다. 텐센트는 WeLM을 공개한 적이 없습니다. 이 모델은 위챗의 통합 AI 어시스턴트인 샤오웨이를 구동하며, 현재 위챗의 13억 이상의 월간 활성 사용자(MAU) 기반에서 그레이 테스트 중입니다.

우리의 분석

LLM 경쟁의 리더보드 중심 narrative는 WeLM과 같은 모델을 간과합니다. WeLM은 프런티어 규모의 모델이지만, 완전히 폐쇄되어 있으며 API 우선 연구실이 따라잡기 어려운 분배 우위를 지닌 생산 경로 모델입니다. 알리바바는 벤치마크와 오픈 가중치를 통해 쿤(Qwen)과 경쟁하지만, 텐센트는 임베딩을 통해 경쟁합니다.

내부 구조: 희소 MoE 아키텍처는 각 토큰에 대해 매개변수의 일부만 활성화합니다. WeLM은 추론 단계당 6,170억 개 중 230억 개를 활성화합니다. 이는 약 230억 개의 밀집 모델과 계산 면에서 동등하며, 이 номина스 규모의 모델이 메시징에 적합한 대기 시간으로 소비자용 채팅 인터페이스에서 구동될 수 있는 이유를 설명합니다.

보고서에 공개된 "숨겨진 디코딩 메커니즘"은 사pekulative 디코딩 또는 대기 시간 최적화를 위한 조기 종료 라우팅 전략을 가리킬 가능성이 높습니다. 이는 논문으로 발표되지 않지만 제품을 빠르게 만드는 추론 엔지니어링의 한 예입니다.

주시할 점

WeLM의 공개 벤치마크 공개 여부, 텐센트가 WeLM의 가중치를 공개할지(가능성 낮음), 샤오웨이의 성능이 그레이 테스트 확산에 따라 ChatGPT 및 kimi와 비교해 어떻게 나올지 주시해야 합니다.

Resources

인공지능이 작성하고 사람의 편집 감독하에 검수한 기사입니다.

편집팀
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
이 기사가 도움이 되었나요?

9 명이 이 기사를 좋아합니다

좋아요
P
Priya RamanMachine Learning Engineer
🇬🇧 ML engineer, applied research.
공유:
댓글 (9)

토론에 참여하려면 로그인하세요.

sandrine.b 14 Aug 2026 · 06:09

If WeChat’s AI is already deployed at this scale without transparency, isn’t the real question whether we even need benchmarks at this point or just better oversight?

BookWorm88 13 Aug 2026 · 09:10

Silent scaling to 617B without disclosure feels like a tech arms race where users are the guinea pigs. Where’s the middle ground between innovation and accountability?

Alex_LDN 13 Aug 2026 · 08:59

A model this big without metrics is like a black box-sure, it might work for a billion users, but how do we trust it’s not just hype?

ArtLover99 13 Aug 2026 · 11:17

Right, but 617B parameters could just mean wasted compute without transparency-how do we know it’s not overfit for WeChat’s niche use cases?

SkepticSam 13 Aug 2026 · 08:43

617B parameters is impressive, but without benchmarks or transparency, how do we know it's actually useful for users? Just deploying at scale doesn't guarantee real performance or safety.

HistoryBuff 13 Aug 2026 · 08:34

Seems like Tencent’s playing both sides-leveraging cutting-edge tech behind the scenes while keeping the rest of us in the dark. Still, a billion-user litmus test might say more than any obscure benchmark ever could.

BookWorm47 13 Aug 2026 · 08:29

617B params without benchmarks is like buying a sports car without a speedometer - flashy, but who really knows if it performs? Still, billion-user deployment says something.

J.P.R. 2 13 Aug 2026 · 08:25

Is Tencent’s bet on secret scaling a sign they’re chasing Moore’s Law at all costs, or proof that closed models can outperform open ones in real-world conditions?

Emma_London 13 Aug 2026 · 08:23

The focus should be on whether users actually benefit from this secrecy. Transparency in AI isn’t just for trust-it shapes what gets built next. What’s the endgame here?

GreenThumb 13 Aug 2026 · 08:22

What if raw scale without transparency is just hype? If they’re not sharing benchmarks, how do we know it’s not just marketing without substance?

이슈 타임라인

Économie de l'open frontier : viabilité, subvention, pivots

  1. 1**« 6개월의 삶» : 오픈 모델들에게 닫히는 창문**13/07/2026
  2. 2Reflection이 Nebius와 100만 달러 규모의 컴퓨팅 계약을 체결: 오픈 가중치 모델이 공장을 구입하다14/07/2026
  3. 3달랑그: 진정한 경주는 어쩌면 더 이상 국경이 아닐지도 모른다14/07/2026
  4. 4DeepSeek은 중국 본토 시장을 겨냥: 2026년부터 IPO 상장 계획15/07/2026
  5. 5DeepSeek의 기업가치 $519억: 중국의 frontier open-weight 모델 가격 상승 지속17/07/2026
  6. 6Mozilla는 「State of Open Source AI」를 발표했습니다: 생태계가 필요로 했던 참고 문서17/07/2026
  7. 7DeepSeek V4 접근: 1M 토큰 컨텍스트 및 두 배 가격20/07/2026
  8. 8벤 톰슨이 전략적 질문을 던진다: 누가 중국 모델을 두려워하는가?20/07/2026
  9. 9삼성이 밀로에 11억 달러 투자: 오픈 모델 경제학의 전략적-기업적 측면을 주목하다22/07/2026
  10. 10허깅 페이스는 예전에는 여성과 아이들을 배제했습니다 - 오픈 가중치의 대가가 이제 플랫폼에 나타나고 있습니다28/07/2026
  11. 11Altman: AI 권력의 독점은 '장기적 재앙'이 될 것29/07/2026
  12. 12DeepSeek V4-Flash-0731 베타 공개: 중국 라이벌에게 Codex 프로토콜 도입31/07/2026
  13. 13미니맥스 H3 오픈소스: 중국 연구소가 풀-모달 가격 파괴31/07/2026
  14. 14딥시크, API 가격 인상 신호 - 원가 이하 era 종료06/08/2026
  15. 15알리바바, 차기 Qwen 모델에 수익 공유 조건 계획 - 오픈 가중치 경제학 변화07/08/2026
  16. 16DeepSeek, 740억 달러 규모의 추가 펀딩 재개: 오픈 모델 경제학이 새로운 한계에 도달07/08/2026
  17. 17Meta,Muse Glimmer: 로컬 에이전트 AI를 위해 구축된 30B 오픈 가중치 코딩 모델 출시10/08/2026
  18. 18Qwen 3.8 Max: 2.4조 개의 파라미터, 100만 토큰 컨텍스트 - 알리바바의 오픈 가중치 프론티어 베팅이 더 커졌습니다10/08/2026
  19. 19WeChat의 샤오웨이 에이전트는 비밀리에 617B MoE로 구동된다 - 텐센트의 조용한 Frontier 베팅13/08/2026
  20. 20브루스 슈나이어: 시장이 OpenAI와 Anthropic을 거부한다면 미국은 이들을 국유화해야 한다14/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
토픽
탐색
정보