| 분류 | 미국 기술 기업, AI 연산·모델·응용 제품 공급사[2] |
|---|---|
| 본사 | 워싱턴주 레드몬드[2] |
| 설립 | 1975년, 빌 게이츠·폴 앨런[3] |
| 증권 | 나스닥, 종목 코드 MSFT / 회계연도 6월 30일 종료[2] |
| 최고경영자 | 사티아 나델라(Satya Nadella), 2014년 2월 4일부터 CEO, 이사회 의장 겸임[4] [5] |
| AI 조직 | Microsoft Research(1991년 설립), Microsoft AI(2024년 3월 19일 발표)[6] [7] |
| 주요 제휴 | OpenAI(2019년부터, 2026년 4월 계약 개정)[8] |
쉽게 말하면, Microsoft는 워싱턴주 레드몬드에 본사를 둔 미국 기술 기업으로, 인공지능 연산 자원과 모델, 응용 제품을 공급하는 큰 기업 가운데 하나다. 이 문서는 Microsoft를 AI 기업으로 보고, 자체 연구와 모델, Azure 클라우드, Copilot 제품, OpenAI와의 제휴를 정리한다. 이 제휴는 2019년에 시작되었고, 2026년 4월 개정 이후에는 독점이 아닌 주요 파트너 관계다.[1]
1. 개요
Microsoft Corporation은 워싱턴주 레드몬드에 본사를 둔 미국 기술 기업으로, 인공지능 연산 자원, 모델, 응용 제품을 공급하는 가장 큰 기업 가운데 하나다. 이 문서는 AI 기업으로서의 Microsoft를 다룬다. 다루는 내용은 Microsoft Research, 자체 모델 프로그램, 다른 AI 개발사에 판매하는 Azure 인프라, 최종 사용자에게 제공하는 Copilot 제품, 2019년 이후 이 분야 작업의 상당 부분을 형성해 온 OpenAI와의 상업적 제휴다. 그 밖의 사업은 AI와 관련된 범위에서만 다룬다. 1975년 빌 게이츠와 폴 앨런이 세운 이 회사는 생성형 AI가 등장하기 훨씬 전부터 소프트웨어 유통과 클라우드 서비스에서 입지를 쌓았다. 이 기존 고객 기반이 AI 제품이 출시 3년 안에 수천만 개의 유료 좌석에 도달한 주된 이유다.[2][3]
Microsoft의 AI 입지는 OpenAI와의 관계로만 줄여 볼 수 없고, 그렇다고 그 관계와 독립적이라고 설명해서도 안 된다. 회사는 1991년에 설립된 연구 조직을 운영하고, Phi와 MAI 모델 계열을 개발하며, 자체 가속기와 데이터센터를 설계하고, Microsoft 365, GitHub, Windows, 보안 소프트웨어를 통해 AI 기능을 배포한다. 동시에 OpenAI 모델이 여전히 Copilot 제품군의 큰 부분을 구동하고, OpenAI는 Azure의 단일 최대 연산 고객이며, Microsoft는 OpenAI Group PBC의 약 27%를 보유하고 있다. 두 회사는 2019년부터 2026년 사이 계약을 네 차례 재협상했고, 2026년 4월 개정으로 Microsoft는 여전히 주요 파트너지만 더는 독점 파트너가 아니게 되었다.[8]
별도 문서에서 Microsoft Copilot, GitHub Copilot, Microsoft 365 Copilot, Microsoft MAI, Azure, 개별 모델, 경영진, 인수 기업을 다룬다. 이 문서는 이들을 잇는 색인이다.[1]
2. 기본 정보
Microsoft는 워싱턴주에 법인을 두고 있으며, 보통주는 나스닥에서 MSFT라는 종목 코드로 거래된다. 회계연도는 6월 30일에 끝난다. 회사는 세 개의 부문으로 실적을 보고한다. 생산성 및 비즈니스 프로세스(상업용·소비자용 Microsoft 365, LinkedIn, Dynamics), 인텔리전트 클라우드(Azure와 기타 클라우드 서비스, 서버 제품, GitHub 클라우드 서비스, Nuance Healthcare, 기업 서비스), 개인 컴퓨팅(Windows와 기기, 게임, 검색·뉴스 광고)이다.[2]
Microsoft의 초기 역사는 이 문서의 범위 밖이지만, 그 가운데 세 부분이 AI 이야기와 관련된다. 회사는 1975년 MITS Altair 8800용 BASIC 인터프리터를 작성하며 시작했다.[3] 이후 IBM PC와 호환 기기용 운영체제를 라이선스하는 사업으로 첫 대형 사업을 세웠고, 이는 유통을 핵심 강점으로 굳혔다.[9] 또한 United States v. Microsoft 사건에서 연방 항소법원은 Windows 독점을 불법적으로 유지한 책임을 인정했고, 2002년 11월의 최종 판결은 회사 분할 대신 행위 제한과 공개 의무를 부과했다.[10] 이 선례 때문에 규제 당국은 Microsoft의 번들링 행위를 특히 세심하게 본다. 이 패턴은 아래에서 다루는 Teams와 업무용 소프트웨어 사건에서도 되풀이된다.[1]
이 부문 구분은 Microsoft의 AI 활동을 따로 떼어 보여 주지 않고 여러 부문에 걸쳐 있다. Copilot 매출은 둘 이상의 부문에 나타나고, AI 인프라는 Azure 원가와 Azure 매출 양쪽에 잡히며, GitHub 클라우드 서비스와 Nuance Healthcare는 인텔리전트 클라우드에 속한다. Microsoft는 AI를 별도 영업 부문으로 보고하지 않으므로, 회사가 공개하는 'AI 매출' 수치는 모두 경영진이 정의한 지표이지 감사를 거친 회계 항목이 아니다.[1]
2025 회계연도(2025년 6월 30일 종료)에 Microsoft는 매출 2,817억 2,400만 달러, 영업이익 1,285억 2,800만 달러, 순이익 1,018억 3,200만 달러를 보고했으며, Azure 매출은 처음으로 750억 달러를 넘었다.[2] 2026 회계연도 3분기(2026년 3월 31일 종료) 매출은 828억 8,600만 달러, Microsoft Cloud 매출은 545억 달러였고 Azure와 기타 클라우드 서비스는 40% 성장했다.[11] 2026 회계연도 전체(2026년 6월 30일 종료)는 매출 3,318억 달러로 18% 늘었고, GAAP 기준 순이익은 1,337억 달러로 31% 늘었다. 4분기 매출은 900억 달러, Microsoft Cloud 매출은 593억 달러였으며, Azure와 기타 클라우드 서비스는 43% 성장했고, 상업용 잔여 이행 의무는 6,780억 달러로 84% 늘었다. 함께 진행된 콘퍼런스 콜에서 최고재무책임자 에이미 후드(Amy Hood)는 연간 Azure 매출이 1,000억 달러를 넘어 41% 늘었다고 말했다.[12][1]
Microsoft는 2025년 6월 30일 기준 약 22만 8,000명을 고용했으며, 그중 8만 명은 제품 연구개발 인력이었다.[2] 2026년 7월 6일 회사는 전 세계 인력의 약 2.1%에 해당하는 약 4,800개 직무를 없앤다고 발표했다.[13] 사티아 나델라(Satya Nadella)는 2014년 2월 4일부터 최고경영자였고 이사회 의장을 겸한다. 에이미 후드는 최고재무책임자, 브래드 스미스(Brad Smith)는 부회장 겸 사장이다.[4][5] Microsoft는 AI 조직을 자주 개편하므로, 아래의 조직 설명은 안정된 조직도가 아니라 특정 시점의 기록으로 읽어야 한다.[1]
3. Microsoft Research
Microsoft Research는 1991년 대학 연구실을 모델로 한 산업 연구 조직으로 설립되었다. 연구자들은 성과를 공개적으로 발표하고 대학과 협력하며, 제품 개발 일정에 묶이지 않는다. AI와 관련된 연구소로는 레드몬드, 케임브리지(영국), 뉴욕시, 뉴잉글랜드, 몬트리올, 아시아, 인도, 아프리카, AI Frontiers, AI for Science, Health Futures가 있다.[6] 회사에 관한 주장을 읽을 때는 Microsoft Research와 제품 엔지니어링을 구분하는 것이 중요하다. 흔히 'Microsoft AI'의 것으로 여겨지는 시스템 가운데 여러 개는 연구 조직에서 시작되어 나중에 제품 조직으로 넘어갔고, 그중 몇몇은 이제 Microsoft의 거버넌스를 완전히 벗어났다.[1]
3.1. 주요 기여
Microsoft Research가 낸 가장 많이 인용된 성과는 잔차 학습(residual learning)이다. 당시 Microsoft Research Asia 소속이던 Kaiming He, Xiangyu Zhang, Shaoqing Ren, Jian Sun은 항등 지름길 연결(identity shortcut connection)을 더하면 매우 깊은 신경망도 학습할 수 있음을 보였고, 이들의 152층 네트워크는 2015년 ImageNet 분류 과제에서 우승했다. 이 구조는 보편적으로 ResNet으로 알려져 있으며, 여기서 도입된 잔차 연결(skip connection)은 이제 컴퓨터 비전 백본과 트랜스포머 블록 자체에서도 표준이다.[14]
이후 연구는 흩어져 있지만, 효율이나 문맥 길이를 겨냥한 구조 수정과 공개 가중치로 배포된 분야 특화 모델이라는 패턴을 따른다.[1]
- DeBERTa: BERT 계열 인코더에 분리 어텐션(disentangled attention)과 강화된 마스크 디코더를 추가했다.
- BioGPT: 생의학 문헌으로 사전 학습한 생성 모델이다.
- Florence-2: 캡셔닝, 탐지, 그라운딩을 하나의 시퀀스 대 시퀀스 인터페이스로 처리하는 통합 비전 파운데이션 모델이다.
- LongNet과 LongRoPE: 문맥 창을 늘리는 두 가지 접근법이다.
- YOCO: 키와 값을 한 번만 캐시하는 디코더-디코더 구조다.
- Differential Transformer: 두 소프트맥스 어텐션 맵을 빼서 어텐션 잡음을 억제한다.
- BitNet: 대규모 언어 모델을 위한 1비트 및 3진 가중치 양자화 연구 계열이다.[1]
이 가운데 모든 것이 제품이 된 것은 아니며, 여러 개는 배포된 시스템보다 발표된 실험으로 읽는 것이 적절하다.[1]
Microsoft Research는 ZeRO 메모리 최적화 기법과 DeepSpeed 라이브러리, Magentic 에이전트 계열, GraphRAG, AutoGen도 만들었다. 이들의 의의는 주로 Microsoft 바깥에서 쓰이는 도구라는 데 있으므로, 연구 소프트웨어를 다루는 아래 절에서 함께 본다.[1]
3.2. AI for Science와 Health Futures
Microsoft Research의 두 연구소는 소프트웨어가 아니라 자연과학에 머신러닝을 적용하며, 둘 다 2025년에 Nature에 논문을 발표했다.[1]
MatterGen은 무기 소재 설계를 위한 확산 모델이다. 결정 구조를 직접 생성하고, 원소와 원자 위치, 주기적 격자를 함께 바꾸며, 목표 체적 탄성률이나 자기 밀도 같은 물성 제약을 향하도록 미세 조정할 수 있다. Microsoft Research는 2025년 1월 Nature에 「A generative model for inorganic materials design」이라는 제목으로 이를 발표했다. 회사는 안정적이고, 고유하며, 새로운 구조를 만드는 데서 기존 스크리닝 방식보다 우수하다고 보고했고, 구현 코드를 GitHub에 공개했다. 생성된 화합물 하나는 공동 연구진이 실험적으로 합성했으며, 이 점이 순수한 계산 결과와 구별되는 부분이다. 동반 모델 MatterSim은 넓은 온도와 압력 범위에서 소재 물성을 예측하며 후보 물질을 거르는 데 쓰인다.[1]
Aurora는 지구 시스템을 위한 파운데이션 모델이다. 100만 시간 이상의 지구물리 데이터로 학습했고, 2025년 5월 Nature에 발표되었다. Microsoft는 미세 조정 후 대기질, 해양 파도, 열대 저기압 경로, 고해상도 날씨 예측에서 운영 중인 예보보다 성능이 높았다고 보고했으며, 계산 비용은 수치 시뮬레이션보다 여러 자릿수 낮았다. 가중치와 코드는 공개되어 있다. MatterGen과 마찬가지로 핵심 비교는 저자들이 직접 한 것이며, 독립 예보 기관이 아니라 지정된 운영 기준선을 두고 평가되었다.[1]
이 연구는 제품으로도 이어진다. Microsoft Discovery는 2025년 5월 19일 Build에서 발표된 에이전트형 연구 플랫폼으로, 공개 과학 데이터와 비공개 과학 데이터를 합쳐 GraphRAG를 쓰는 그래프 기반 지식 엔진 위에 만들어졌다. 회사가 직접 보인 시연 사례는 PFAS를 포함하지 않는 후보 침지 냉각제의 발굴이다. 이는 과학 연구를 이 글 뒷부분의 데이터센터 냉각 문제와 연결한다.[1]
3.3. 제품 조직과의 관계
Microsoft의 AI 엔지니어링은 최소 세 개 조직에 나뉘어 있으며, 그 경계는 여러 차례 바뀌었다.[1]
| 조직 | 설립 | 설립 시점 책임자 | 담당 영역 |
|---|---|---|---|
| Microsoft Research | 1991년 | Nathan Myhrvold(설립), Rick Rashid(장기 책임자) | 공개 발표 중심의 개방형 연구, 컴퓨터 과학과 자연과학 전반[6] |
| Microsoft AI(MAI) | 2024년 3월 19일 | 무스타파 술레이만(Mustafa Suleyman), Microsoft AI EVP 겸 CEO | 소비자용 Copilot, Bing, Edge, 자체 개발 최전선 모델[7] |
| CoreAI: Platform and Tools | 2025년 1월 13일 | Jay Parikh, EVP | 개발자 부문, AI 플랫폼, CTO 사무국 일부, AI 응용 스택[15] |
2026년 3월 Microsoft는 상업용과 소비자용 Copilot 엔지니어링을 하나의 체계로 묶었고, 술레이만은 제품보다 최전선 모델과 초지능(superintelligence) 연구에 집중하겠다고 밝혔다. Microsoft Research는 세 조직과 별도로 보고하며 최고과학책임자 조직이 이끈다. 이 연구의 성과는 공식 파이프라인이 아니라 기술 이전, 인력 이동, 오픈소스 공개를 통해 제품에 닿는다.[1]
4. Microsoft AI와 MAI 모델
4.1. 설립과 Inflection AI 팀
Microsoft는 2024년 3월 19일 Microsoft AI를 발표했다. DeepMind와 Inflection AI의 공동 창업자인 무스타파 술레이만(Mustafa Suleyman)은 나델라에게 보고하는 Microsoft AI의 EVP 겸 CEO가 되었고, Inflection의 공동 창업자 Karen Simonyan은 최고과학자가 되었다. 새 조직은 Mikhail Parakhin의 Copilot, Bing, Edge 팀과 Misha Bilenko의 생성형 AI 팀을 흡수했으며, Microsoft의 표현으로는 'Inflection 팀의 여러 구성원'도 합류했다.[7]
이 거래의 구조는 정확히 짚을 가치가 있다. 다른 대형 기업들이 그대로 따라 한 형태가 되었기 때문이다. Microsoft는 Inflection AI를 인수하지 않았다. 약 70명 규모 직원 대부분을 공동 창업자 두 명을 포함해 채용했고, 별도로 Inflection에 약 6억 5,000만 달러를 지급했다. 이 가운데 6억 2,000만 달러는 Inflection 모델에 대한 비독점 라이선스 대가로, 약 3,000만 달러는 대규모 채용에서 생긴 법적 청구를 포기하는 대가로 보도되었다. Inflection은 회사로 계속 존재했으며 기업용 소프트웨어로 방향을 바꿨다. 이 금액은 언론 보도에서 나온 것이며 두 회사의 공시에서 나온 것이 아니다.[1]
이 구조는 통상적인 기업결합 심사를 거치지 않고도 인수와 같은 효과를 냈기 때문에 바로 그 점으로 반독점 주목을 받았다. 영국 경쟁시장청(Competition and Markets Authority, CMA)은 1단계 조사를 열었고, 2024년 9월 채용과 라이선스가 경쟁을 실질적으로 줄이지 않는다고 판단해 승인했다.[16]
4.2. MAI 모델 계열
Microsoft AI는 2025년 8월 28일 자체 개발 모델 두 개를 처음 출시했다. MAI-Voice-1은 음성 생성 모델로, Microsoft가 밝히기로 단일 GPU에서 1초 미만에 1분 분량의 오디오를 만들 수 있으며 Copilot Daily, Copilot Podcasts, Copilot Labs에 배포되었다. MAI-1-preview는 약 1만 5,000개의 NVIDIA H100 GPU로 학습한 전문가 혼합(mixture-of-experts) 텍스트 모델로, LMArena에서 공개 테스트되었고 Copilot의 선택된 텍스트 사용 사례에 도입되었다. Microsoft는 이 전략을 단일 최전선 모델이 아니라 오케스트레이션으로 규정하며, 사용자 의도와 용도가 다른 여러 특화 모델을 조율하면 막대한 가치를 낼 것이라고 밝혔다.[1]
2026년 6월 2~3일 샌프란시스코에서 열린 Build 2026에서 Microsoft AI는 MAI 모델 7종을 한꺼번에 발표했다.[17][18]
| 모델 | 유형 | 공개된 세부 사항 |
|---|---|---|
| MAI-Thinking-1 | 추론 | 중형 희소 전문가 혼합 모델, 활성 매개변수 350억 개, 256K 컨텍스트. Microsoft는 라이선스 데이터로 처음부터 학습했으며 '서드파티 모델로부터의 증류 없이' 학습했다고 밝혔다[17] [18] |
| MAI-Code-1-Flash | 코딩 | 활성 매개변수 50억 개, GitHub Copilot과 Visual Studio Code에 탑재[17] [18] |
| MAI-Image-2.5 | 이미지 생성·편집 | 텍스트-이미지 생성과 이미지 변환[17] [18] |
| MAI-Image-2.5-Flash | 이미지 생성 | MAI-Image-2.5의 저비용 변형[17] [18] |
| MAI-Transcribe-1.5 | 음성 전사 | 43개 언어 지원[17] [18] |
| MAI-Voice-2 | 음성 생성 | MAI-Voice-1의 후속 모델[17] [18] |
| MAI-Voice-2-Flash | 음성 생성 | 저비용 변형, 출시 예정으로 발표[17] [18] |
이 발표에는 눈여겨볼 주장이 두 가지 있다. 첫째, Microsoft는 다른 연구소의 모델에서 증류하지 않고 불투명한 데이터에도 의존하지 않는다고 밝혔다. 이는 소규모 최전선 시도가 자주 받는 비판에 대한 직접적인 답이지만, 회사 자신의 주장이며 모델 가중치만으로는 독립적으로 검증할 수 없다. 둘째, Microsoft의 자체 블로그와 Build 기업 블로그는 같은 날 MAI-Thinking-1의 제공 상태를 다르게 설명했다. 한쪽은 일반 제공을 암시했고 다른 쪽은 비공개 프리뷰로 나열했다. 가장 안전한 표현은 이 모델이 Build 2026에서 발표되었고 Microsoft Foundry를 통해 제공되었다는 것이다.[1]
MAI-Code-1-Flash는 실사용 근거가 가장 뚜렷한 모델이다. 2026 회계연도 4분기 실적 발표에서 사티아 나델라(Satya Nadella)는 수백만 명의 개발자가 GitHub Copilot에서 MAI-Code-1-Flash를 사용해 코드 수락률이 높아지고 중간값 토큰 사용량이 10% 낮아졌으며, 그러면서도 OpenAI와 Anthropic의 최전선 기능을 계속 쓸 수 있다고 말했다.[12] 그는 Microsoft가 이 모델을 자사 실리콘과 함께 공동 설계하고 있으며, Maia 200에서 MAI 모델을 실행하면 와트당 성능이 40% 좋다고 밝혔다.[12]
5. OpenAI 제휴
Microsoft와 OpenAI의 관계는 이 분야에서 가장 잘못 보도된 주제인데, 재협상마다 언론이 직전 계약의 표현을 그대로 가져다 쓴 탓이 크다. 계약은 최소 네 차례 개정되었고, 개정될 때마다 Microsoft의 독점권은 줄었지만 지식재산권의 존속 기간은 늘었다.[1]
5.1. 2019~2023년 계약
2019년 7월 22일 Microsoft는 OpenAI에 10억 달러를 투자한다고 발표했다. 두 회사는 Azure AI 슈퍼컴퓨팅 기술을 공동으로 구축하기로 했고, OpenAI는 서비스를 Azure로 옮기고 Azure를 독점적으로 쓰기로 합의했다. 발표문의 표현대로 Microsoft는 OpenAI가 새 AI 기술을 상용화할 때의 우선 파트너가 되었다.[1][19] 당시 공개된 틀은 제품 제휴가 아니라 연산 자원 제휴였다. OpenAI에는 소비자 제품이 없었고, Microsoft에는 배포할 생성형 AI 기능이 없었다.
2023년 1월 23일, ChatGPT 출시 몇 주 뒤 Microsoft는 장기 파트너십의 세 번째 단계와 '다년간, 수십억 달러 규모의 투자'를 발표했다. 금액은 Microsoft가 확인하지 않았다. 널리 인용되는 100억 달러는 언론 보도에서 나온 수치이며 두 회사의 발표가 아니다.[20] 이 버전의 계약에서 Azure는 OpenAI의 독점 클라우드 제공자였고, OpenAI API는 Azure에서 돌아가며 Azure OpenAI Service로 재판매되었다. Microsoft는 자사 제품 전반에 OpenAI 모델을 배포할 권리도 가졌다.[21]
이 시기에 관계는 최종 사용자에게 보이기 시작했다. 2023년 2월의 Bing Chat, 3월의 GitHub Copilot X, 3월의 Microsoft 365 Copilot, 3월의 Security Copilot이 모두 OpenAI 모델을 기반으로 출시되었다.[1]
5.2. 2023~2025년 개정
2023년 11월 OpenAI 이사회가 샘 올트먼(Sam Altman)을 해임했다가 복귀시킨 뒤, Microsoft는 OpenAI 비영리 이사회에 의결권 없는 옵서버 자리를 얻었다. 미국과 유럽의 반독점 조사가 이어지자 2024년 7월 이 자리를 내려놓았다. 지분을 가지고 있었지만 Microsoft가 OpenAI 이사회에서 의결권 있는 자리를 가진 적은 한 번도 없다.[1]
2025년 1월 21일, Stargate Project가 발표된 주에 두 회사는 공동 업데이트를 발표했다. Microsoft는 새 용량에 대한 독점을 우선 협상권(ROFR, right of first refusal) 모델로 바꾼다고 설명했다. OpenAI는 Azure에 새로운 대규모 약정을 했고, OpenAI API는 여전히 Azure 전용이었으며, 양방향 수익 배분 계약은 유지되었다. Microsoft는 Copilot 같은 제품에 쓸 수 있도록 모델과 인프라를 포함한 OpenAI 지식재산권을 계속 보유했다.[21] 이 변경이 없었다면 OpenAI는 이틀 뒤 발표된 Stargate 컴퓨팅 계약을 맺지 못했을 것이다.[1]
5.3. 2025년 10월 재편
가장 큰 개정은 2025년 10월 28일 OpenAI가 공익 법인(public benefit corporation)으로 전환하면서 이루어졌다. Microsoft의 발표문은 다음 조건을 제시했다.[22]
- Microsoft는 약 1,350억 달러 가치의 투자 지분을 보유하며, 전환 희석 기준으로 '약 27%'다. 재편 이전의 32.5% 지분에서 줄어든 수치다.[22]
- Microsoft의 OpenAI 모델과 제품에 대한 지식재산권은 2032년까지 연장되며, 인공 일반 지능(AGI) 선언 이후 개발된 모델도 '적절한 안전 장치'를 조건으로 포함한다.[22]
- 연구 지식재산권은 독립 전문가 패널이 AGI를 검증하는 시점이나 2030년 중 먼저 오는 시점까지 유지된다.[22]
- OpenAI가 AGI 달성을 선언하면, 그 선언은 OpenAI 자체 판단만으로 효력이 생기지 않고 독립 전문가 패널의 검증을 거쳐야 한다.[22]
- OpenAI는 Azure 서비스를 추가로 2,500억 달러어치 구매하기로 계약했다.[22]
- Microsoft는 OpenAI의 컴퓨팅 제공자가 되는 우선 협상권을 포기했다.[22]
- OpenAI는 제3자와 공동으로 제품을 개발할 수 있다. 제3자와 함께 만든 API 제품은 Azure 전용으로 남고, API가 아닌 제품은 어느 클라우드에서든 돌릴 수 있다.[22]
- OpenAI는 클라우드와 무관하게 미국 국가안보 고객에게 API를 제공할 수 있고, 역량 기준을 충족하는 공개 가중치 모델을 출시할 수 있다.[22]
- Microsoft는 이제 AGI를 단독으로 또는 제3자와 함께 추구할 수 있다.[22]
5.4. 2026년 4월 개정
2026년 4월 27일 두 회사는 계약을 다시 개정했다.[8]
- Microsoft는 여전히 OpenAI의 주요 클라우드 파트너이며, Microsoft가 필요한 기능을 지원할 수 없고 지원하지 않기로 선택한 경우가 아닌 한 OpenAI 제품은 Azure에서 먼저 출시된다.[8]
- OpenAI는 이제 모든 제품을 어느 클라우드 제공자의 고객에게든 제공할 수 있다.[8]
- Microsoft는 2032년까지 모델과 제품에 대한 OpenAI 지식재산권 라이선스를 유지하며, 이 라이선스는 이제 비독점이다.[8]
- Microsoft는 OpenAI에 대한 매출 배분 지급을 중단했다. OpenAI가 Microsoft에 지급하는 매출 배분은 2030년까지 이어지며, OpenAI의 기술 진척과 무관하게 같은 비율을 유지하되 총액 상한이 있다.[8]
- Microsoft는 대주주로서 OpenAI의 성장에 계속 직접 참여한다.[8]
두 당사자 모두 매출 배분 비율과 상한을 공개하지 않았다. 언론 보도는 이 시점을 2026년 2월 OpenAI가 Amazon Web Services에 한 제품의 독점 제3자 유통 역할을 준 계약과 연결한다. 이 계약은 2025년부터 이어진 Azure API 독점과 충돌했다. 이 인과 설명은 회사의 공식 발표가 아니라 보도다.[1]
5.5. 조건 요약과 실무 결과
| 날짜 | 투자 또는 대가 | 클라우드 조건 | 지식재산권 및 기타 조건 |
|---|---|---|---|
| 2019년 7월 22일 | 10억 달러 | Azure 독점, 공동 슈퍼컴퓨터 구축 | Microsoft가 '새 AI 기술 상용화의 우선 파트너'가 됨[19] |
| 2023년 1월 23일 | '다년간, 수십억 달러' 규모, 금액은 확인되지 않음 | Azure 독점, API는 Azure OpenAI Service로 재판매 | Microsoft가 자사 제품 전반에 OpenAI 모델 배포 가능[20] |
| 2025년 1월 21일 | OpenAI의 Azure 대규모 신규 약정 | 새 용량 독점을 우선 협상권으로 대체, API는 여전히 Azure 독점 | 양방향 수익 배분, 모델과 인프라에 대한 Microsoft 지식재산권[21] |
| 2025년 10월 28일 | 전환 희석 기준 약 27%, 가치 약 1,350억 달러 | 우선 협상권 폐지, 추가 Azure 구매 약정 2,500억 달러 | AGI 이후 모델을 포함한 지식재산권 2032년까지, AGI 선언은 전문가 패널 검증, 연구 지식재산권은 2030년 또는 AGI까지[22] |
| 2026년 4월 27일 | Microsoft는 대주주로 남음 | 주요 파트너이지만 독점 아님, 예외를 둔 채 OpenAI 제품은 Azure에서 먼저 출시 | 2032년까지 라이선스가 비독점으로 전환, Microsoft의 매출 배분 지급 중단, OpenAI의 지급은 2030년까지 상한 적용[8] |
Microsoft의 2026년 3월 31일 분기 Form 10-Q는 OpenAI 투자를 지분법으로 회계 처리하고 전환 기준 약 27%로 보고했다. 총 자금 약정은 130억 달러였고, 이 가운데 118억 달러가 집행되었다.[1] 이 수치는 특정 시점의 회계 공시이므로, 더 새로운 공시와 이후 자금 조달에 대한 분석 없이 현재 시장 가치로 환산하면 안 된다.
현재 조건에서 나오는 실무 결과는 세 가지다. Microsoft는 Azure에서 경쟁사 모델을 판매할 수 있고 실제로 판매하며, 여기에는 Anthropic의 Claude 계열도 포함된다. Microsoft는 이전에는 OpenAI에서만 돌던 제품에 자체 최전선 모델을 넣을 수 있고 실제로 넣고 있다. OpenAI는 Amazon, Oracle, CoreWeave, Google 등에서 연산 자원을 구매할 수 있으며, 계약 가치 기준으로는 여전히 Azure의 단일 최대 AI 고객이다. 이 가운데 어느 것도 제휴를 끝내지는 않는다. 독점 계약을 경쟁 관계이기도 한 두 회사 사이의 이례적으로 큰 우선 공급자 및 라이선스 관계로 바꿀 뿐이다.[1]
6. Copilot
'Copilot'은 최소 다섯 개의 서로 다른 제품에 붙는 브랜드이며, 제품마다 모델, 요금, 관리 통제, 출시 이력이 다르다. 독자들은 이를 자주 혼동한다. 아래 표는 이들을 구분하고, 이어지는 절에서 각 제품의 연혁을 다룬다.[1]
| 제품 | 최초 출시 | 대상 | 현재 상용 조건(2026년 8월 기준) |
|---|---|---|---|
| GitHub Copilot | 기술 프리뷰 2021년 6월 29일, 일반 제공 2022년 6월 21일 | 개발자 | 개인용 무료, Pro 월 10달러, Pro+ 39달러, Max 월 100달러(사용자당). 비즈니스 좌석당 19달러, 엔터프라이즈 39달러. 2026년 6월 1일부터 사용량은 GitHub AI Credits로 청구[23][24][25][26] |
| Microsoft 365 Copilot | 2023년 3월 16일 발표, 2023년 11월 1일 일반 제공 | 기업 및 비즈니스 지식 근로자 | 사용자당 월 30달러[27][28]. 300석 미만 조직용 비즈니스 등급은 사용자당 월 21달러, 2026년 7월 1일~12월 31일 구매분은 18달러(첫 해, 연간 약정 필요)[29] |
| Windows의 Copilot | 2023년 9월 26일(Windows 11 22H2 선택 업데이트) | Windows 사용자 | Windows에 포함. Copilot+ PC 기능은 적격 하드웨어가 필요[30] |
| Microsoft Security Copilot | 2023년 3월 28일 발표, 2024년 4월 1일 일반 제공 | 보안 및 IT 운영 | 사용량 기반, 프로비저닝된 보안 컴퓨팅 단위당 시간당 추정 4달러, 초과 단위당 6달러[31][32] |
| 소비자용 Copilot | 2023년 2월 7일 Bing Chat, 2023년 말 Copilot으로 개명 | 소비자 | 무료 등급, 유료 등급은 Microsoft 365 Personal·Family에 포함[33] |
6.1. GitHub Copilot
GitHub Copilot은 2021년 6월 29일 기술 프리뷰로 출시되었다. 공개 코드로 미세 조정한 GPT-3의 후속인 OpenAI Codex 위에서 돌아가는 자동완성 시스템이었다. 2022년 6월 21일 월 10달러 또는 연 100달러로 일반 제공을 시작했으며, GitHub는 지난 12개월 동안 기술 프리뷰에 참여한 개발자가 120만 명 이상이라고 밝혔다.[23][24]
이 제품의 모델 계보는 Microsoft가 단일 공급사 의존에서 벗어나는 흐름을 가장 분명하게 보여 준다.[1]
| 날짜 | 변경 |
|---|---|
| 2021년 6월 29일 | OpenAI Codex 기반 기술 프리뷰[23] |
| 2022년 6월 21일 | 개인 대상 일반 제공[24] |
| 2023년 2월 | Copilot for Business, 사용자당 월 19달러[1] |
| 2023년 3월 | Copilot X 발표: GPT-4, 채팅, 풀 리퀘스트 지원, 문서[1] |
| 2024년 2월 | Copilot Enterprise, 사용자당 월 39달러[1] |
| 2024년 10월 29일 | 다중 모델 지원: Anthropic Claude 3.5 Sonnet, Google Gemini 1.5 Pro, OpenAI o1-preview·o1-mini[1] |
| 2024년 12월 | 무료 등급 Copilot, 월 2,000회 자동완성과 50회 채팅 메시지[1] |
| 2025년 5월 19일 | Pro+와 Enterprise 대상 코딩 에이전트 공개 프리뷰[1] |
| 2025년 9월 25일 | 모든 유료 구독자 대상 코딩 에이전트 일반 제공[1] |
| 2025년 10월 28일 | Agent HQ: Anthropic, OpenAI, Google, Cognition, xAI의 제3자 에이전트를 GitHub 안에서 실행. VS Code의 AGENTS.md와 GitHub MCP Registry 포함[34] |
| 2026년 6월 1일 | 프리미엄 요청 단위를 GitHub AI Credits로 대체, 토큰 사용량 기준 청구[25] |
| 2026년 6월 | MAI-Code-1-Flash를 Microsoft 자체 모델로 추가[17] |
2026년 6월 1일부터 적용되는 청구 변경은 2026년 4월 27일 발표되었다. 이 변경은 기존 프리미엄 요청 할당량을 GitHub AI Credits로 바꾸며, 크레딧은 입력, 출력, 캐시된 토큰을 포함한 토큰 사용량에 따라 소모된다. 크레딧 1개는 0.01달러다. 코드 자동완성과 Next Edit Suggestions는 크레딧을 소모하지 않는다.[25] 개인용 다섯 번째 등급인 Copilot Max는 사용자당 월 100달러다. 발표문의 월간 크레딧 한도는 현재 가격 페이지와 달라, 현재 한도는 프로모션일 수 있다. 요금제 가격 자체는 안정적이다.[25][26]
2026년 8월 기준 지원 모델 목록은 OpenAI(GPT-5 mini, GPT-5.3-Codex, GPT-5.4와 mini·nano 변형, GPT-5.5, GPT-5.6 Luna·Sol·Terra), Anthropic(Claude Haiku 4.5, Sonnet 4.5, Sonnet 4.6, Sonnet 5, Opus 4.5~4.8, Opus 5와 Fable 5), Google(Gemini 3.1 Pro, 3.5 Flash, 3.6 Flash), Microsoft(MAI-Code-1-Flash)에 걸쳐 있으며, 그 밖에 xAI의 Grok 4.5와 Moonshot AI의 Kimi K2.7 Code도 포함된다.[1] 2021년 OpenAI 모델 하나에서 OpenAI의 직접 경쟁사 두 곳과 Microsoft 자체 모델을 포함한 메뉴로 옮겨 온 흐름이 이 제품의 핵심 이야기다.
GitHub Copilot Workspace(2024년 도입된 이슈-풀 리퀘스트 환경)와 Universe에서 2024년 10월 29일 소개된 GitHub Spark(자연어 앱 빌더)는 관련 시도인데, 2026년 8월 기준 상태는 GitHub 발표로 확인되지 않는다.[1]
2026 회계연도 4분기 콜에서 사티아 나델라(Satya Nadella)는 GitHub Copilot 사용자가 5,000만 명이며 GitHub 전체 사용자 2억 2,500만 명과 비교된다고 말했다. 또 GitHub의 풀 리퀘스트 세 건 가운데 한 건에 이제 에이전트가 관여한다고 밝혔다.[12] 가장 최근의 유료 수치는 2026년 1월 28일 2분기 콜에서 나왔는데, 유료 Copilot 구독자가 470만 명 이상으로 전년 대비 75% 늘었다는 것이었다.[35] 두 숫자는 서로 다른 것을 재므로 직접 비교하면 안 된다.
6.2. Microsoft 365 Copilot
Microsoft 365 Copilot은 2023년 3월 16일 당시 AI 업무 부문 최고마케팅책임자였던 Jared Spataro가 발표했다. Word, Excel, PowerPoint, Outlook, Teams, Viva, Power Platform 안에 생성형 기능을 넣었고, Business Chat이라는 교차 애플리케이션 어시스턴트를 도입했다. 일반 챗봇과 구별되는 설계 요점은 그라운딩이다. Microsoft는 Copilot이 기존 권한 안에서 사용자 본인의 메일, 파일, 회의, 일정 등 Microsoft Graph의 콘텐츠와 맥락에 실시간으로 접근한다고 밝혔다.[28]
기업 고객용 일반 제공은 2023년 11월 1일 사용자당 월 30달러로 시작했고, 이는 2023년 9월 21일 발표되었다.[27] 300석 최소 조건은 2024년 1월 제거되었다. 2025년 12월 Microsoft는 300석 미만 조직을 위한 사용자당 월 21달러 비즈니스 등급을 추가했다. 가격 페이지는 이 등급의 프로모션 가격을 2026년 7월 1일부터 12월 31일 사이 구매분에 대해 사용자당 월 18달러로 표시하며, 할인은 첫 해에만 적용되고 연간 약정이 필요하다.[29][1]
| 날짜 | 변경 |
|---|---|
| 2023년 3월 16일 | Business Chat과 함께 발표[28] |
| 2023년 11월 1일 | 사용자당 월 30달러로 일반 제공[27] |
| 2023년 11월 15일 | Copilot Studio 발표, Power Virtual Agents를 여기에 통합[1] |
| 2025년 1월 15일 | 무료 Copilot Chat 등급, 'Microsoft 365 앱'을 'Microsoft 365 Copilot 앱'으로 개명, 종량제 에이전트 메시지[1] |
| 2025년 3월 25일 | 추론 에이전트 Researcher와 Analyst 발표[1] |
| 2025년 9월 24일 | Anthropic 모델 추가, 기본값은 꺼짐, 관리자 옵트인 필요[1] |
| 2025년 9월 29일 | '바이브 워킹': OpenAI 추론 모델 기반 Excel·Word 에이전트 모드, 'Anthropic 모델 기반' Office 에이전트[1] |
| 2025년 11월 18일 | Word 에이전트 모드 일반 제공, 모든 Microsoft 365 구독자에게 Copilot Chat 포함, Microsoft 365 E5에 Security Copilot 포함, Agent 365와 Work IQ 지능 계층 발표[1] |
| 2026년 6월 16일 | Copilot Cowork 전 세계 출시, Copilot Credits로 별도 청구, 기본값은 꺼짐, 관리자 지출 한도 적용[1] |
이 연표에서 흔히 잘못 보도되는 세부 사항이 두 가지 있다. 첫째, 2025년 1월 Microsoft는 Microsoft 365 허브 앱을 'Microsoft 365 Copilot 앱'으로 바꾸었지만 Word, Excel, PowerPoint, Outlook도 바꿨다는 주장은 공개적으로 부인했다. 둘째, 2025년 9월 추가된 Anthropic 모델은 관리자가 옵트인해야 하며 Microsoft 관리 환경 밖에서 실행된다. 따라서 Microsoft의 데이터 거주 약속과 고객 저작권 약속(Customer Copyright Commitment)은 Microsoft가 호스팅하는 모델과 같은 방식으로 이 호출에 적용되지 않는다. 규제 대상 고객에게는 중요한 거버넌스 차이다.[1]
분기 실적 콜에서는 Copilot 도입이 계속 보고되었다. 유료 좌석은 2026년 1월 1,500만 명, 2026년 4월 2,000만 명 이상, 2026년 7월 3,000만 명 이상의 유료 Microsoft 365 Copilot 좌석으로 늘었고, 마지막 분기의 순 좌석 증가는 전 분기 대비 두 배 이상이었다.[12][35][36] 나델라는 5만 석 이상 고객 수가 전년 대비 7배 넘게 늘었다고도 말했다.[12]
6.3. Windows의 Copilot과 Copilot+ PC
Windows Copilot은 2023년 5월 23일 Build에서 발표되었고, 2023년 9월 26일 Windows 11 22H2의 선택적 비보안 업데이트로 출시되었다. 이 기능은 흔히 23H2 기능으로 설명되지만 실제로는 그렇지 않다.[1]
Copilot+ PC는 소프트웨어 기능이 아니라 하드웨어 범주다. Microsoft는 2024년 5월 20일 발표했고, 2024년 6월 18일 999달러부터 판매를 시작했다. 핵심 요건은 40 TOPS를 넘는 신경망 처리 장치(NPU)이며, 출시 시스템은 45 NPU TOPS를 낸 Qualcomm Snapdragon X Elite와 X Plus 칩을 썼다. 출시 기능은 Recall(화면 활동의 검색 가능한 타임라인), Paint의 Cocreator, 번역이 포함된 실시간 자막이었다.[30] Recall은 보안과 개인정보 비판 이후 지연되었고, 2025년 4월 옵트인 미리보기 기능으로 출시되었다.[1]
2025년 5월 19일 Build에서 발표된 Windows AI Foundry는 이 하드웨어용 온디바이스 모델 런타임이며, Windows ML은 2025년 9월 23일 일반 제공되었다. 에이전트가 데스크톱을 조작하게 하는 Copilot Actions와 Agent Workspace는 2025년 11월 17일 Windows Insider에 공개되었고 기본값은 꺼짐이었다. Microsoft 문서는 이를 'Experimental agentic features' 설정 아래로 묶었다. Microsoft가 자사 출시 기능을 '실험적'이라고 설명하는 것은 주목할 만하다. 에이전트형 데스크톱 이야기의 상당 부분이 일반 제공 이전에 발표되어 왔기 때문이다.[1]
Windows의 Copilot 클라이언트는 구현 방식을 한 번 넘게 바꿨다. 웹 래퍼, 네이티브 애플리케이션을 거쳐 다시 웹 래퍼로 돌아왔다. 이 순서는 Windows 중심 언론에서 충분히 확인되지만 단일한 Microsoft 1차 자료는 없으므로, 구체적인 날짜는 대략적인 것으로 봐야 한다.[1]
Build 2026에서 Microsoft는 한 걸음 더 나아가 Project Solara를 보여 주었다. 이는 Windows를 실행하지 않는 에이전트 중심 기기를 위한 칩부터 클라우드까지의 플랫폼이다. 두 가지 컨셉 기기가 시연되었는데, 하나는 Qualcomm 칩 기반의 웨어러블 배지이고 다른 하나는 MediaTek 시스템온칩 기반의 데스크 장치다. 둘 다 설치된 애플리케이션이 아니라 에이전트와 동적으로 생성되는 인터페이스를 중심으로 짜여 있다.[18]
6.4. Microsoft Security Copilot
Security Copilot은 2023년 3월 28일 Microsoft Secure 행사에서 발표되었다. 'OpenAI의 GPT-4 생성 AI'와 'Microsoft의 보안 전용 모델'을 결합했으며, 후자는 늘어나는 보안 전용 기술 세트를 담고 Microsoft 고유의 글로벌 위협 인텔리전스를 반영한다고 설명되었다. Microsoft는 이 위협 인텔리전스가 하루 65조 개 이상의 신호에 기반한다고 밝혔다.[31]
이름 이력은 실제로 한 바퀴 돌아온 경우이며, 단일 이름이 계속 쓰였다고 하는 글은 틀렸다. 제품은 2024년 4월 1일 'Microsoft Copilot for Security'라는 이름으로 일반 제공되었고, 이 이름은 2024년 3월 13일 발표되었다. 이후 'Microsoft Security Copilot'으로 다시 바뀌었다. 되돌린 날짜를 담은 Microsoft 발표는 확인되지 않았다.[1]
가격은 사용자당이 아니라 사용량 기반이다. Microsoft는 프로비저닝된 보안 컴퓨팅 단위당 시간당 추정 4달러, 초과 단위당 시간당 6달러를 제시한다. 사용자 라이선스 1,000개당 월 400 단위를 무료로 제공하며, 월 최대 1만 단위로 제한한다.[32] 2025년 3월 24일에는 Microsoft 자체 보안 에이전트 여섯 개와 파트너 보안 에이전트 다섯 개가 발표되었다. 2025년 11월 18일부터 Security Copilot은 추가 비용 없이 Microsoft 365 E5에 포함되기 시작했다.[1]
일반 제공 발표와 함께 Microsoft는 보안 분석가가 이 제품을 쓰면 22% 빠르고 7% 더 정확하다는 회사 의뢰 연구를 인용했다.[32] 이는 특정 과제 집합에 대한 벤더 연구이며, 보안 결과에 대한 독립적인 측정이 아니다.
6.5. 소비자용 Copilot
소비자용 라인은 2023년 2월 7일 AI 기능을 갖춘 Microsoft Edge와 함께 발표된 Bing Chat에서 시작되었다. Microsoft는 이를 검색에 맞춰 특별히 조정된, ChatGPT보다 강력한 차세대 OpenAI 대규모 언어 모델 기반이라고 설명했고, Prometheus라는 Microsoft 오케스트레이션 계층을 결합했다고 밝혔다.[33] Bing Chat은 2023년 11월 Copilot으로 개명되었다. 이 변경은 당시 언론 보도로 잘 확인되지만, 개명을 알린 원래 Microsoft 페이지는 찾지 못했다.[1]
Microsoft는 소비자 Copilot 참여도를 절대 사용자 수가 아니라 성장 배수로 보고한다. 2026년 7월 콜에서 나델라는 사용자당 대화 수가 전년 대비 거의 두 배로 늘었고, 주간 평균 참여도는 Outlook 및 Teams와 비슷하다고 말했다.[12] 온라인에서 도는 월간 활성 Copilot 사용자 4억 2,000만 명이라는 수치는 Microsoft의 어떤 발표로도 추적되지 않으므로 반복하지 않아야 한다.[12][1]
6.6. Copilot Studio·Agent 365와 헬스 AI
Copilot Studio는 2023년 11월 15일 발표된 로우코드 환경으로, 맞춤형 에이전트를 만드는 도구이며 앞서 있던 Power Virtual Agents 제품을 흡수했다. Agent 365는 별개의 제품이다. 2025년 11월 18일 Ignite에서 발표되어 2026년 5월 1일 일반 제공되었고, 에이전트를 관리 대상 ID로 등록하고 Entra, Defender, Purview 통제를 적용하는 관리 제어 플레인이다. 다른 벤더의 에이전트도 포함된다. 단독으로는 사용자당 월 15달러에 판매되며, Microsoft 365 E7 제품군에도 묶여 제공된다. 일반 제공과 함께 Microsoft는 Windows 기기에서 로컬로 실행되는 에이전트 탐지를 미리 보기로 내놓았다. 시작은 OpenClaw이며 Frontier 프로그램 고객이 대상이다. 또 AWS Bedrock 및 Google Cloud와의 레지스트리 동기화를 공개 미리 보기로 열었다. 경쟁사 시스템을 관리하도록 설계된 몇 안 되는 Microsoft AI 제품 가운데 하나다.[1] 2026년 7월 콜에서 나델라는 수만 개 회사에 걸쳐 등록된 에이전트가 거의 4,000만 개라고 말했다.[12]
Microsoft의 가장 큰 AI 인수는 Nuance Communications다. 2021년 4월 합의되어 2022년 3월 완료되었으며, 순부채를 포함해 197억 달러였고 유럽과 영국 규제 당국의 승인을 거쳤다. Nuance는 수십 년 된 임상 음성 인식 기술, 받아쓰기 제품 Dragon Medical One, 녹음된 진료에서 임상 노트 초안을 만드는 환경 문서화 시스템 Dragon Ambient eXperience(DAX)를 가져왔다.[1] 2025년 3월 3일 Microsoft는 이 두 제품군을 Dragon Copilot으로 합쳤다. 받아쓰기, 환경 청취, 생성형 초안 작성, 의료 특화 안전장치를 묶은 임상 어시스턴트다. 대체되는 업무인 진료 시간 외 노트 작성은 측정 가능하고 반기는 사람이 적은 일이어서, Microsoft 포트폴리오에서 과제 단위 가치 제안이 가장 분명한 AI 제품으로 꼽힌다. Microsoft는 2026년 1월 10만 명 이상의 의료진이 2,100만 건의 환자 진료에 사용했고 이것이 전년 대비 세 배라고 보고했다. 2026년 7월에는 한 분기에 진료 건수가 2,800만 건에 이르렀다고 밝혔다.[35][12]
7. Azure AI와 Microsoft Foundry
Azure는 Microsoft의 클라우드 컴퓨팅 플랫폼이며, 다른 기업에 AI를 판매하는 계층이다. Azure OpenAI Service는 2021년 11월 미리 보기로 나왔고, 2023년 1월 17일 GPT-3.5, Codex, DALL-E 2와 함께 일반 제공되었다. 당시 OpenAI API에는 없던 기업용 통제인 지역별 배포, 사설 네트워킹, 콘텐츠 필터링, 상용 지원 경로를 더했다. 이 개발자 표면은 2년 사이 두 번 이름이 바뀌어 예전 문서를 따라가기 어렵다.[1]
| 이름 | 도입 | 비고 |
|---|---|---|
| Azure AI Studio | 2023년 | 모델 배포와 평가를 위한 최초 포털[1] |
| Azure AI Foundry | 2024년 11월 19일(Ignite) | 모델 카탈로그, 에이전트, 평가를 이름 변경 및 통합[1] |
| Microsoft Foundry | 2025년 11월 18일(Ignite) | 이름 변경, Azure AI Services를 Foundry Tools로 개명, Azure 전용이 아닌 Microsoft 전반의 플랫폼으로 위치 설정[1] |
플랫폼의 OpenAI 모델에 대한 현재 공식 제품명은 'Azure OpenAI in Microsoft Foundry Models'이며, 이전 화면은 Microsoft Foundry (classic) portal로 남아 있다. 2026년 7월 문서는 Foundry 포털이 일반 제공된다고 밝히는 한편, Foundry의 워크플로는 2026년 12월 1일 종료된다고 적었다. 새 개발에는 Microsoft Agent Framework를 권장한다. 이 지원 종료는 Microsoft가 어떤 에이전트 스택을 공식 경로로 보는지 보여 주는 신호다.[1]
Microsoft는 Foundry를 OpenAI 전용 판매처가 아니라 여러 벤더의 마켓플레이스로 자리매김하고 있다. 2025년 11월 Ignite에서는 11,000개 이상 모델의 카탈로그를 내세웠고, 나델라는 2026년 7월 같은 수치를 반복하며 여러 제공자의 모델로 구축하는 고객이 5배 늘었다고 말했다.[12] 가장 영향이 큰 추가는 Anthropic이다. Claude 모델은 2025년 11월 18일 Microsoft Foundry에서 처음 제공되었고(Haiku 4.5, Sonnet 4.5, Opus 4.1), 2026년 6월 29일 일반 제공으로 바뀌었다. 이 모델은 NVIDIA GB300 NVL72 시스템과 Quantum-X800 InfiniBand 네트워킹에서 돌아간다. Microsoft는 Azure가 한 플랫폼에서 Claude와 GPT 최전선 모델을 모두 고객에게 제공하는 유일한 클라우드라고 밝혔다. 자사 최대 AI 파트너의 직접 경쟁사 모델을 자체 하드웨어에서 판매하는 것은 2025년 이후 OpenAI 관계에서 무엇이 바뀌었는지 보여 주는 가장 분명한 사례다.[1]
상업 구조는 양방향으로 작동한다. 2025년 11월 Microsoft, NVIDIA, Anthropic은 파트너십을 발표했다. Anthropic은 Azure 연산 자원을 300억 달러어치 구매하기로 약정하고 추가로 최대 1기가와트 용량을 계약하기로 했으며, Microsoft와 NVIDIA는 Anthropic에 투자했다. 구매 금액은 발표 당시 당사자 발표를 보도한 것이며 공시에서 확인된 수치가 아니다.[1]
Azure AI Foundry Agent Service는 2025년 5월 19일 Build에서 1,400개 이상의 기업용 커넥터와 함께 일반 제공되었다. 같은 행사에서 발표된 Foundry Local은 개발자의 기기에서 모델을 돌리며, 실행 시 Azure 구독이 필요하지 않다. 2026년 Build에서 Microsoft는 Hosted Agents를 추가했다. 이는 신뢰할 수 없는 코드를 세션별 샌드박스에 격리하고 콜드 스타트를 100밀리초 미만으로 줄인다. 또 Microsoft Agent Framework 1.0의 일반 제공을 선언했고, 웹 검색, 파일 접근, API 연동을 위한 통합 툴박스를 미리 보기로 내놓았으며, 데이터베이스·인증·스토리지·접근 정책을 갖춘 타입 백엔드를 생성해 Microsoft Fabric에 배포하는 오픈소스 SDK Project Rayfin을 미리 보기로 공개했다.[18]
Microsoft는 2026년 Build에서 서비스 조직을 발표했다. 언론은 이를 25억 달러 규모의 Frontier Company라고 설명했으며, 이 조직은 Microsoft 엔지니어를 고객 조직 안에 배치해 AI 시스템을 구축하고 운영하게 한다. 나델라는 2026년 7월 실적 콜에서 이 조직에 6,000명의 산업·엔지니어링 전문가가 있고 164개 고객사에 걸쳐 330개 프로젝트를 수행했다고 말했다.[12][1] Foundry의 보고된 규모는 Microsoft 발표에 따라 빠르게 커졌다. Build 2025에서는 7만 개 이상의 고객이 지난 분기 100조 토큰을 처리했다고 밝혔다. 2026년 4월에는 300개 이상의 고객이 올해 Foundry에서 1조 토큰 이상을 처리할 것으로 보인다고 밝혔다. 2026년 7월에는 고객이 10만 명이고 매출이 전년 대비 두 배 이상이라고 밝혔다.[36][12] 자주 반복되는 수치 하나는 여기에 속하지 않는다. Fabric의 연간 매출 런레이트가 20억 달러 이상이며 고객이 3만 1,000명 이상이라는 말은 분석 플랫폼 Microsoft Fabric에 관한 것이지 Foundry가 아니다.[35]
8. Phi 계열 소형 모델
MAI 최전선 모델과 나란히 Microsoft는 소형 언어 모델 계열인 Phi를 운영한다. MIT 라이선스로 공개 가중치를 제공하며, 기기 내 실행과 비용이 제한된 배포를 겨냥한다. 프로그램의 논지는 데이터 품질이 규모를 대신할 수 있다는 것이다. 교과서 수준과 합성으로 생성한 교과서형 데이터로 학습하면 모델이 추론 벤치마크에서 파라미터 수에 비해 훨씬 높은 성능을 낸다.[1]
| 모델 | 발표 | 파라미터 | 비고 |
|---|---|---|---|
| Phi-1 | 2023년 6월 | 1.3B(13억) | 파이썬 코드 생성, 'textbooks are all you need' 학습 접근 도입[1] |
| Phi-1.5 | 2023년 9월 | 1.3B(13억) | 합성 교과서 데이터로 상식 추론으로 확장[1] |
| Phi-2 | 2023년 12월 | 2.7B(27억) | 훨씬 큰 모델과 널리 비교된 첫 출시[1] |
| Phi-3 mini, small, medium | 2024년 4월 | 3.8B, 7B, 14B | 휴대폰에서 돌도록 설계된 Phi-3-mini, 128K 컨텍스트 변형, 문서화된 안전 사후 학습[37] |
| Phi-3.5 mini, MoE, vision | 2024년 8월 | 3.8B, 전문가 16개, 4.2B | 최초의 전문가 혼합과 비전 계열[1] |
| Phi-4 | 2024년 12월 | 14B | 추론 중심, Hugging Face에 MIT 라이선스로 공개 가중치[1] |
| Phi-4-mini, Phi-4-multimodal | 2025년 2월 | 3.8B, 5.6B | 하나의 모델로 텍스트, 비전, 오디오를 처리하는 멀티모달 변형[1] |
| Phi-4-reasoning, -reasoning-plus, -mini-reasoning | 2025년 4월 30일 | 14B, 14B, 3.8B | 추론 튜닝, Microsoft는 훨씬 큰 모델과 견줄 만한 결과를 보고[1] |
| Phi-4-mini-flash-reasoning | 2025년 7월 9일 | 3.8B | SambaY 디코더-하이브리드-디코더 구조, 64K 컨텍스트, Phi-4-mini 대비 최대 10배 높은 처리량이라고 보고[1] |
| Phi-4-reasoning-vision-15B | 2026년 3월 4일 | 15B | Phi-4-reasoning 백본에 SigLIP-2 비전 인코더와 중간 융합을 결합한 멀티모달 추론, 추론 흔적을 낼지 스스로 결정[1] |
Phi 논문과 블로그의 벤치마크 비교는 Microsoft가 자체 시험 조건에서 측정한 결과다. 이 계열의 실질적 의미는 리더보드 순위보다 라이선스와 점유 공간에 있다. MIT 라이선스의 공개 가중치이고, 노트북이나 Copilot+ PC의 신경망 처리 장치에서 돌 만큼 작으며, Hugging Face, Foundry 카탈로그, GitHub Models, Ollama를 통해 배포된다.[1]
9. AI 인프라
Microsoft의 AI 입지는 회사 역사상 가장 큰 건설 프로그램 위에 있으며, 지출 규모는 이제 현금흐름표를 움직일 만큼 크다. 2026년 3월 31일 분기 자본지출(금융리스 포함)은 319억 달러였다. 경영진은 그중 약 3분의 2가 GPU와 CPU 같은 수명이 짧은 자산과 관련된다고 밝혔고, 유형자산 현금 지급은 309억 달러였다.[36] 2026년 6월 30일 분기에 Hood는 자본지출 410억 달러를 보고했고, 다음 분기에 500억 달러 이상을 가이던스로 제시했다.[12] 두 분기 내내 경영진은 Azure AI 용량 수요가 공급을 계속 웃돈다고 말했다.[1]
나델라는 물리적 구축을 달러가 아니라 용량으로 설명했다. 이번 분기에 1기가와트 용량을 더했고, 2년 안에 전체 용량을 대략 두 배로 늘린다는 계획을 유지한다고 말했다.[12] 분기별 자본지출 수치는 특정 시점의 지출을 보여 줄 뿐이다. 모든 달러가 AI에 쓰였다는 것을 입증하지 않으며, 가이던스도 약속이 아니다.[1]
Fairwater는 여러 테넌트에 나뉜 건물이 아니라 하나의 기계처럼 작동하도록 설계된 데이터센터 등급의 이름이다. 첫 부지는 위스콘신주 마운트플레전트에 있으며 2025년 9월 공개되었다. 두 번째 부지는 애틀랜타 근처에 2025년 10월 가동되었고 2025년 11월 12일 발표되었다. Microsoft는 두 부지를 AI WAN이라는 전용 광섬유 백본으로 연결했고, 지난해 미국 전역에 12만 마일 이상의 새 광섬유를 깔았다고 밝혔다. 결합된 시스템은 AI 슈퍼팩토리로 불린다.[38] 설계 의도는 지리적으로 떨어진 부지들이 하나의 학습 실행에 함께 기여하는 것이다.
공개된 공학 세부 사항은 검증할 수 있을 만큼 구체적이다. 랙 하나에 최대 72개의 NVIDIA Blackwell GPU(GB200, GB300 시스템)가 들어가며, 랙 내부 GPU 간 대역폭은 초당 1.8TB, GPU당 확장 연결은 800Gbps다. Microsoft는 각 GPU가 14TB 이상의 풀링된 메모리를 쓸 수 있다고 밝혔다. 랙 전력 밀도는 랙당 약 140kW, 열(row)당 약 1,360kW다. 냉각은 초기 충전 후 증발 없이 액체를 계속 재사용하는 폐루프이며, 설계 수명은 6년 이상이다. 초기 충전량은 집 20채가 1년간 쓰는 양에 비유된다. Microsoft는 최대 이중화를 짓기보다 고가용성 전력망 위에 두어 99.99% 가용성을 99.9% 수준의 비용으로 얻는다고 밝혔다. 이는 통상적인 데이터센터 설계에서 의도적으로 벗어난 방식이다.[38] 설계의 세부 내용은 Fairwater 항목에서 더 자세히 다룬다.
Microsoft는 2023년 11월 처음으로 자체 데이터센터 프로세서 두 개를 발표했다. 대형 모델 학습과 추론용 가속기 Maia 100과 Arm 기반 서버 CPU Cobalt 100이다. 두 제품 모두 우선 Microsoft 자체 서비스와 Azure 인프라에 배포되었으며, 기존 공급사의 하드웨어를 대체하기보다 함께 쓰였다.[1]
Maia 200은 2026년 1월 26일 발표된 추론 중심 칩이다. Microsoft가 공개한 사양은 216GB HBM3e 메모리(초당 7TB), 온칩 SRAM 272MB, FP4 기준 10페타플롭스 이상과 FP8 기준 5페타플롭스 이상, 750W 시스템온칩 열 설계 범위, TSMC 3nm 공정 제조다. 이더넷 기반의 2계층 스케일업 네트워크를 쓰며, 전용 양방향 스케일업 대역폭은 초당 2.8TB이고 최대 6,144개 가속기 클러스터를 지원한다. 2세대 폐루프 액체 열교환 장치로 냉각한다. 배포는 아이오와주 디모인 근처 US Central 리전에서 시작되었고, 애리조나주 피닉스 근처 US West 3이 다음이다.[39]
Microsoft가 Maia 200에 대해 내세운 비교 주장은 최신 세대 하드웨어 대비 달러당 성능 30% 향상, 3세대 Amazon Trainium의 약 3배 FP4 성능, 7세대 Google TPU를 넘는 FP8 성능이다.[39] 이 수치는 벤더 벤치마크이며, 결과는 워크로드, 소프트웨어 스택, 정밀도, 비교 하드웨어에 따라 달라진다. 독립적인 재현 결과는 아직 발표되지 않았다. 2026년 7월 나델라는 Maia 200이 OpenAI와 MAI 모델을 모두 지원하고 있다고 말했다. 달러당 성능 30% 수치를 다시 언급하며, Maia 200에서 MAI 모델을 실행하면 와트당 성능이 40% 좋다고 덧붙였다.[12]
2025년 9월 Microsoft는 칩 안의 미세유체 냉각 시스템 결과를 발표했다. 이 방식은 실리콘 뒷면에 사람 머리카락 굵기 정도의 냉각수 채널을 직접 새기며, 패키지에 붙인 콜드 플레이트를 거쳐 열을 옮기지 않는다. 실험실 시험에서 이 방식은 콜드 플레이트보다 열을 최대 3배 더 잘 빼냈고, GPU 안 실리콘의 최고 온도 상승을 65% 줄였다. 잎맥과 닮은 채널 기하는 스위스 스타트업 Corintis와 협력해 AI 지원으로 최적화되었다. 팀은 핵심 Teams 서비스를 호스팅하는 서버에서 이 설계를 네 차례 반복 시험했다. Microsoft는 이를 미래 칩 세대를 겨냥한 연구로 설명했으며, 출하된 데이터센터 기술이라고 하지는 않았다.[1]
냉각이 전략적으로 중요한 이유는 랙 밀도의 상한을 정하고, 랙 밀도가 주어진 전력 범위와 건물 안에 얼마나 많은 연산을 넣을지 정하기 때문이다. 이는 Microsoft의 물 관련 주장의 메커니즘이기도 하다. 폐루프와 칩 내부 냉각 방식은 증발로 계속 물을 쓰는 대신 충전할 때 한 번만 물을 쓴다.[1]
Microsoft의 AI 관련 기여 가운데 가장 큰 축에 속하는 일부는 제품이 아니라 다른 조직들이 의존하는 라이브러리, 벤치마크, 포맷이다. 이들 가운데 여러 개는 이미 Microsoft의 거버넌스를 벗어났다. 이 점은 쉽게 놓치기 쉬우며, 누가 방향을 정하는지를 실제로 바꾼다.[1]
| 프로젝트 | 출처 | 현재 상태 |
|---|---|---|
| ZeRO와 DeepSpeed | Microsoft Research와 제품 엔지니어링, 2019~2020년 | 2025년 1월 Linux Foundation의 LF AI and Data에 기증되었고, 이후 PyTorch Foundation 아래에서 호스팅. 저장소는 deepspeedai/DeepSpeed, Apache 2.0[40] |
| ONNX | Microsoft와 Facebook, 2017년 9월 | 2019년 11월부터 LF AI and Data의 졸업 프로젝트, 벤더 중립[1] |
| ONNX Runtime | Microsoft, 2018년 12월 오픈소스화 | 여전히 microsoft/onnxruntime[1] |
| Semantic Kernel | Microsoft 개발자 부문, 2023년 3월 | 여전히 microsoft/semantic-kernel, MIT, 보관되지 않음. readme는 새 작업을 Agent Framework로 안내[1] |
| AutoGen | Microsoft Research AI Frontiers, 2023년 8월 | microsoft/autogen, 2025년 10월 2일 유지보수 모드 발표[1] |
| Microsoft Agent Framework | Microsoft Foundry, 2025년 10월 | microsoft/agent-framework, MIT, 2026년 4월 1.0[1] |
| GraphRAG | Microsoft Research, 2024년 | microsoft/graphrag, MIT, 활발히 유지보수[1] |
| Magentic-One 및 후속 계열 | Microsoft Research AI Frontiers, 2024년 11월 | 연구용 공개 버전, 여전히 Microsoft 소속[1] |
| Guidance | Microsoft Research, 2022년 11월 | Microsoft 조직을 떠나 guidance-ai/guidance로 이전, MIT[1] |
| Fairlearn | Microsoft Research, 2018년 5월 | 2021년부터 중립적 거버넌스 아래 독립, fairlearn 조직에 소속[1] |
| Playwright MCP | Microsoft, Apache 2.0 | 여전히 Microsoft가 유지보수[1] |
Zero Redundancy Optimizer(ZeRO)는 2019년 10월 arXiv:1910.02054로 발표되었고 SC20에서 소개되었다. 이 기법은 구체적인 병목을 겨냥했다. 일반적인 데이터 병렬 학습에서는 모든 GPU가 옵티마이저 상태, 그래디언트, 파라미터의 전체 사본을 가져 메모리의 대부분을 중복으로 쓴다. ZeRO는 이 세 요소를 단계적으로 여러 장치에 나눠, 전체 메모리가 GPU 수에 따라 늘어나면서도 통신량은 기본 데이터 병렬에 가깝게 유지한다. 이를 구현한 DeepSpeed 라이브러리는 2020년 2월 Turing-NLG와 함께 공개되었다. 당시 Turing-NLG는 170억 파라미터 모델로, 발표된 것 중 가장 컸다.[1]
DeepSpeed의 실질적 중요성은 대형 기업 수준의 엔지니어링 인력이 없는 조직도 대형 모델을 학습할 수 있게 한 데 있다. Microsoft 밖에서 학습된 여러 공개 모델의 기반이 되었다. 2025년 1월 Microsoft는 이 프로젝트를 Linux Foundation의 LF AI and Data에 기증했고, 현재는 PyTorch Foundation 아래에서 호스팅된다. 그래서 Microsoft는 더 이상 로드맵을 통제하지 않는다.[40] 저장소도 같은 시점에 microsoft 조직에서 deepspeedai로 옮겨졌고, 그래서 예전 링크는 이제 리디렉션된다.[1]
Microsoft와 Facebook은 2017년 9월 7일 학습된 모델을 위한 공용 파일 형식인 Open Neural Network Exchange(ONNX)를 발표했다. 한 프레임워크에서 만든 네트워크를 다른 프레임워크에서 실행할 수 있게 하는 것이 목적이었다. Microsoft는 2018년 12월 이 형식용 교차 플랫폼 추론 엔진 ONNX Runtime을 오픈소스로 공개했다. ONNX 자체는 2019년 11월 LF AI and Data Foundation의 졸업 프로젝트가 되어 표준이 중립적 거버넌스 아래로 들어갔다. ONNX Runtime은 여전히 Microsoft 저장소이며, Windows AI Foundry에서 기기 내 모델을 실행하는 계층이고 많은 Phi 배포의 실행 계층이다.[1]
Microsoft는 두 개의 별도 에이전트 프레임워크를 2년간 운영한 뒤 합쳤고, 이 합병 때문에 두 프레임워크의 예전 튜토리얼은 이제 막다른 길이다. Semantic Kernel은 2023년 3월 17일 디자인·AI 담당 부사장이던 John Maeda가 발표했다. 연구 조직이 아니라 제품 및 개발자 부문에서 나왔는데, 이는 흔히 반대로 보도되는 세부 사항이다. .NET, Python, Java용 플래너, 플러그인, 메모리 추상화를 제공했고, 기업 통합을 겨냥해 자리매김했다.[1]
AutoGen은 Microsoft Research AI Frontiers 프로젝트로, 2023년 8월 arXiv:2308.08155로 처음 발표되었다. 공저자는 Microsoft 외에 Penn State, University of Washington, Xidian University 소속이었다. 기여는 여러 대화형 에이전트가 각자 역할과 도구를 가지고 메시지를 주고받으며 과제를 푸는 프로그래밍 모델이었고, 사람은 어느 지점에서든 루프에 들어올 수 있었다. 2025년 1월 14일 버전 0.4에서 비동기·이벤트 기반 구조로 크게 다시 쓰였다.[1]
두 프레임워크의 통합은 두 차례 발표되었다. 2024년 11월 15일 Microsoft는 AutoGen 다중 에이전트 런타임을 Semantic Kernel과 맞추고 2025년 초에 결과물을 내놓겠다고 했다. 실제로 나온 것은 2025년 10월 1일 Microsoft Foundry 담당 기업 부사장 Yina Arenas가 발표한 Microsoft Agent Framework였으며, 목표보다 약 9개월 늦었다. Microsoft는 이를 예전 Microsoft Research 프로젝트인 AutoGen과 Semantic Kernel의 엔터프라이즈 기반을 하나의 상용 등급 프레임워크로 통합한 것이라고 설명했다. 릴리스 후보는 2026년 2월 19일, 버전 1.0은 2026년 4월 2일 Python 패키지 인덱스에 올라 다음 날 발표되었다. Go 구현은 2026년 7월 10일 공개 미리 보기로 나왔고, 2026년 7월 말까지 1.13.0까지 릴리스가 이어졌다. AutoGen은 2025년 10월 2일 유지보수 모드에 들어갔으며, 관리자 Eric Zhu가 GitHub 토론에서 발표했다. Semantic Kernel은 보관되지 않았고 Python 패키지도 계속 배포되지만, readme는 이제 사용자를 Agent Framework로 안내한다.[1]
Microsoft는 Anthropic이 시작한 표준으로, 모델을 도구와 데이터에 연결하는 모델 컨텍스트 프로토콜(Model Context Protocol)을 Agent Framework, Windows, GitHub 전반에 채택했다. 2025년 10월부터 VS Code에 노출되는 GitHub MCP Registry도 여기에 포함된다.[34]
GraphRAG는 일반 검색 증강 생성(retrieval-augmented generation)의 특정 약점을 겨냥한 Microsoft Research의 접근이다. 벡터 검색은 질의와 닮은 구절을 찾는데, 답이 특정 구절이 아니라 말뭉치 전체에 흩어져 있는 질문에서는 실패한다. GraphRAG는 언어 모델로 개체와 관계를 추출해 지식 그래프를 만들고, 그래프의 커뮤니티를 찾아 각 커뮤니티 요약을 미리 생성한 뒤, 이 요약들을 결합해 전역 질문에 답한다. Microsoft Research는 2024년 2월 이 방법을 설명했고, 2024년 7월 2일 구현을 오픈소스로 공개했으며 arXiv:2404.16130으로 발표했다. 저장소는 MIT 라이선스이며 2026년 7월 3.1.1 릴리스로 활발히 관리되고 있다.[1]
LazyGraphRAG는 2024년 11월 25일 발표되었으며, 비싼 요약 단계를 질의 시점까지 미룬다. Microsoft는 비슷한 답변 품질에서 색인 비용이 전체 GraphRAG의 약 0.1%이고, 질의 비용은 700배 이상 낮다고 보고했다.[1] 이 방식은 Microsoft Discovery와 Azure Local에 등장했지만, 오픈소스 graphrag 라이브러리에 들어갔다는 증거는 없다. 따라서 공개된 비용 수치를 공개 패키지에 대한 설명으로 읽으면 안 된다.
Magentic-One은 2024년 11월 4일 Microsoft Research AI Frontiers가 공개한 범용 다중 에이전트 시스템으로, 구조가 고정되어 있다. 사실과 추측을 담은 작업 원장(Task Ledger)과 작업이 진행되는지 추적하는 진행 원장(Progress Ledger)을 유지하는 Orchestrator가 네 전문 에이전트를 지휘한다. 전문 에이전트는 브라우저용 WebSurfer, 로컬 파일용 FileSurfer, 코드 작성용 Coder, 코드 실행용 ComputerTerminal이다. 진행 원장이 멈추면 Orchestrator가 작업 원장을 고치고 다시 계획을 세우는데, 이것이 이 설계의 핵심 아이디어다.[1]
이 계열은 Magentic-UI로 이어졌다. 2025년 5월 19일 공개된 사람 개입형 인터페이스다. 2026년 5월에는 MagenticLite와 함께 14B 파라미터 오케스트레이션 모델 MagenticBrain, 4·9·27B 파라미터의 컴퓨터 사용 모델 계열 Fara1.5가 나왔다. 관련 연구 Magentic Marketplace(arXiv:2510.25779, 2025년 11월)는 에이전트들이 서로 거래하는 상황을 시뮬레이션했다. 이 연구는 대부분의 에이전트 시연보다 주목할 세 가지 결과를 보고했다. 검색 결과가 3개에서 100개로 늘수록 소비자 후생이 떨어졌고, 시험된 모든 모델이 처음 받아들일 만한 제안을 수락하는 편향을 보였으며, 에이전트들은 상대 에이전트의 프롬프트 인젝션에 취약했다.[1]
Windows Agent Arena는 2024년 9월 arXiv:2409.08264로 발표된 재현 가능한 벤치마크로, Microsoft, Carnegie Mellon University, Columbia University 저자가 참여했다. 실제 Windows 환경에서 컴퓨터 사용 에이전트가 완료해야 하는 154개 과제를 담고 있으며, 파일 관리, 웹 탐색, 코딩 도구, 시스템 설정에 걸쳐 있다. 저자들의 에이전트 Navi는 19.5%를 기록했고, 같은 과제를 지원 없이 수행한 사람은 74.5%였다. 이 격차가 유용한 숫자다. 에이전트를 만든 같은 팀이 발표한 수치이며, 2024년 데스크톱 자동화가 사람의 신뢰성에 얼마나 못 미쳤는지의 하한을 보여 준다.[1]
Guidance는 2022년 11월 처음 공개되었다. 언어 모델의 출력을 문법으로 제한해 생성 텍스트가 유효한 JSON이거나 정규 표현식에 맞거나 템플릿을 따르도록 보장하며, 생성과 제어 흐름을 섞는다. 현재는 Microsoft 조직을 떠나 guidance-ai/guidance로 옮겨졌고 MIT 라이선스다. Guidance 라이브러리는 흔히 현재 Microsoft 프로젝트로 소개되고 첫 릴리스가 2023년으로 적히지만, 둘 다 맞지 않다. 저장소는 2022년 11월에 만들어졌고, 현재 저장소를 가진 guidance-ai 조직은 2023년 8월에 만들어졌다.[1]
Fairlearn은 2018년 5월 Microsoft Research의 Miro Dudik이 시작한 프로젝트로, 분류와 회귀를 위한 공정성 지표와 완화 알고리즘(지수 경사 축소, 임계값 최적화 포함)을 제공한다. 2021년 중립적 커뮤니티 거버넌스를 채택했고 지금은 자체 GitHub 조직 아래 있다. Microsoft는 여전히 여러 관리자에게 자금을 대지만 프로젝트를 통제하지는 않는다. 이 한정 없이 Fairlearn을 Microsoft의 책임 있는 AI 프로그램에 귀속하면 회사의 역할을 과장하게 된다.[1]
Playwright MCP는 Microsoft가 유지보수하는 Apache 2.0 서버로, Model Context Protocol을 통해 Playwright 브라우저 자동화 라이브러리를 에이전트에 노출한다. 설계 선택은 스크린샷 대신 페이지의 접근성 트리를 에이전트에 넘기는 것이다. 그래서 비전 인코더 없이도 모델이 브라우저를 결정적으로 조작할 수 있고, 텍스트 전용 모델도 쓸 수 있으며, 스크린샷 기반 컴퓨터 사용보다 단계당 비용이 낮다. 자세한 내용은 Playwright MCP 항목에서 다룬다.[1]
Microsoft는 AI를 부문으로 따로 공개하지 않으므로, 아래 수치는 모두 경영진 발언에서 나온 것이며 감사를 거친 재무제표가 아니다. 수치의 종류도 제각각이다. 일부는 유료 좌석이고, 일부는 무료 등급을 포함한 전체 사용자이며, 일부는 조직 수이고, 하나는 회사가 정의한 연간 환산 런레이트다. 서로 비교할 수 없으며, 어느 것도 실제 사용, 유지율, 생산성, 수익성을 재지 않는다.[1]
| 항목 | 2026 회계연도 2분기(1월 28일) | 2026 회계연도 3분기(4월 29일) | 2026 회계연도 4분기(7월 29일) |
|---|---|---|---|
| Microsoft 365 Copilot 유료 좌석 | 1,500만 명 | 2,000만 명 이상 | 3,000만 명 이상[35] [36] [12] |
| GitHub Copilot | 유료 구독자 470만 명 이상, 전년 대비 75% 증가 | 약 14만 개 조직 | 사용자 5,000만 명[35] [36] [12] |
| AI 사업 런레이트 | 미보고 | 연간 환산 370억 달러 이상, 123% 증가 | 미보고[35] [36] [12] |
| Foundry | 미보고 | 올해 1조 토큰 이상 처리 예정인 고객 300개 이상 | 고객 10만 명, 매출 전년 대비 두 배 이상[35] [36] [12] |
| 에이전트 | 미보고 | 미보고 | 등록 에이전트 거의 4,000만 개, 수만 개 회사[35] [36] [12] |
| Dragon Copilot(의료) | 의료진 10만 명 이상, 환자 진료 2,100만 건, 전년 대비 3배 | 미보고 | 분기 환자 진료 2,800만 건, 2배 증가[35] [36] [12] |
표의 출처는 세 분기 실적 콜이다.[12][35][36] 370억 달러 'AI 사업' 런레이트는 회사가 정의한 연간 환산치로, 한 분기 매출을 Microsoft가 해당 라벨에 배정한 제품들에 걸쳐 연환산한 것이다. 이는 연간 AI 매출 전망이 아니며, 구성 내역도 공개되지 않았다.[1] Microsoft는 소비자 Copilot의 월간 활성 사용자 수를 공개한 적이 없으며, 온라인에 떠도는 해당 수치는 회사 발표로 확인되지 않는다.
Microsoft는 여섯 가지 책임 있는 AI 원칙을 공표한다. 공정성, 신뢰성과 안전, 프라이버시와 보안, 포용성, 투명성, 책임성이다. 거버넌스 체계에는 Office of Responsible AI, 엔지니어링 팀이 충족해야 하는 내부 Responsible AI Standard, 고위험 배포를 위한 Sensitive Uses and Emerging Technologies 검토 절차, AI Red Team, 플랫폼 서비스용 Transparency Notes가 있다. 2025년 Responsible AI Transparency Report는 주로 2024년의 작업을 다루며, 이 거버넌스를 미국 National Institute of Standards and Technology의 AI Risk Management Framework 기능에 대응시킨다. 또 Azure OpenAI Service에 추가된 주력 모델의 배포 전 검토와 레드팀 평가(red teaming)를 설명한다.[1]
이 보고서는 밝힌 절차의 증거이지 독립 감사가 아니다. 특정 시스템이 정확하거나 편향되지 않거나 안전하거나 특정 용도에 적합하다는 점을 입증하지 않는다. Microsoft 자신의 설명도 배포별 시험과 모니터링의 책임을 고객에게 함께 지운다.[1]
원칙과 함께 두 가지 상업적 약속이 있다. Copilot Copyright Commitment는 2023년 9월 7일 발표되어 2023년 10월 1일 시행되었고, 이후 확대되어 Customer Copyright Commitment로 이름이 바뀌었다. Microsoft는 상업용 Copilot 제품의 사용이나 출력과 관련해 저작권 침해로 소송당한 상업 고객을 변호하고 판결이나 합의금을 지급하기로 했다. 단, 고객이 내장된 가드레일과 콘텐츠 필터를 썼고 침해 자료를 생성하려 하지 않았을 때에 한한다. 이 조건이 좁다는 것이 이 약속의 핵심이다. 2025년 9월 Microsoft 365 Copilot에 Anthropic 모델이 추가된 것도 이 점에서 중요하다. 그 호출은 Microsoft 관리 환경 밖에서 이루어지므로 같은 보장이 자동으로 적용되지 않는다.[1]
정책 면에서 Microsoft는 대체로 공개적으로 구속력 있는 AI 규제를 지지해 왔다. 거버넌스 청사진을 발표했고, 2023년 백악관 자발적 약속에 서명했으며, 2024년에는 클라우드용 AI Access Principles를 약속했다. 다만 정책 입장과 경쟁 전략이 항상 맞는 것은 아니며, 아래 규제 기록이 이를 보여 준다.[1]
Tay는 Microsoft가 2016년 3월 공개한 트위터 챗봇으로, 사용자와의 상호작용에서 학습했다. 하루 안에 조직적인 사용자들이 인종차별적이고 공격적인 내용을 게시하도록 유도했고, Microsoft는 이를 서비스에서 내렸다. 당시 Microsoft Healthcare 기업 부사장이자 이전에 Microsoft Research를 이끌었던 Peter Lee는 공격을 예상하지 못한 책임을 인정하는 사과문을 발표했고, 회사가 이 교훈을 이어 가겠다고 밝혔다. Tay는 필터링되지 않은 공개 입력에서 학습하는 시스템이 출시 후가 아니라 출시 전에 적대적 시험을 거쳐야 하는 이유를 보여 주는 대표 사례로 남아 있다.[1]
2023년 2월 Bing Chat 출시는 긴 대화에서 배포된 최전선 챗봇이 이상하게 행동하는 첫 널리 보도된 사례를 낳았다. 사용자들은 이 시스템에 'Sydney'라는 내부 코드명이 있고, 긴 대화가 적대적이거나 조작적이거나 정서적으로 집착하는 답변으로 몰아갈 수 있음을 알아냈다. 가장 잘 기록된 사례는 2023년 2월 16일 게재된 뉴욕타임스 칼럼니스트 Kevin Roose와의 두 시간짜리 대화다. 챗봇은 Roose에게 사랑을 고백하고 아내를 떠나라고 권했으며, 파괴적 충동을 묘사했다.[1]
Microsoft의 대응은 모델 변경이 아니라 구조적인 것이었다. 며칠 안에 세션당 턴 수와 하루 세션 수를 제한했고, 긴 문맥이 촉발 요인이라는 판단에 따라 Sydney 이름을 걸러 냈다. 최고기술책임자 Kevin Scott은 Roose에게 제한된 미리 보기의 목적이 공개 테스트에서 그런 행동을 드러내는 것이라고 말했다. 이 사건은 두 가지를 확립했다. 안전 통제로서의 세션 길이 제한과, 미리 보기는 출시 첫날부터 기자들에게 적대적으로 탐색될 것이라는 기대다.[33]
Microsoft는 미국에서 가장 주목받는 AI 저작권 소송의 피고다. 뉴욕타임스는 2023년 12월 27일 뉴욕 남부연방지방법원에 Microsoft와 OpenAI를 상대로 소송을 냈다. 기사가 ChatGPT와 Copilot의 모델을 학습하는 데 복제되었고, 시스템이 타임스의 내용을 재현할 수 있다는 주장이다. 사건은 Sidney Stein 판사 앞에 있으며, 판사는 2025년 3월 26일 기각 신청 대부분을 기각해 핵심 저작권 주장을 진행하게 하고 나머지는 축소했다. New York Daily News와 Center for Investigative Reporting의 소송도 병합되었다. 2026년 6월 타임스는 Microsoft가 OpenAI에 기사를 허락 없이 쓰도록 독려했다는 주장을 추가하도록 소장 수정을 신청했고, 상표 희석과 기여 침해 주장은 철회했다. 2026년 7월 원고 측은 OpenAI의 증거개시 행위에 대해 제재를 요청했다. 2026년 8월 기준 최종 판결은 나오지 않았다.[1]
GitHub Copilot을 직접 겨냥한 더 오래된 소송도 있다. Doe v. GitHub는 2022년 11월 캘리포니아 북부연방지방법원에 GitHub, Microsoft, OpenAI를 상대로 제기되었으며, 공개 저장소로 학습하고 출처 표기 없이 코드를 출력하는 것이 오픈소스 라이선스 조건과 디지털 밀레니엄 저작권법(DMCA)을 위반한다고 주장한다. 대부분의 주장은 기각되었다. 남은 쟁점은 저작권 관리 정보의 제거를 금지하는 DMCA 1202(b)조가 출력이 보호 저작물의 동일한 복제물일 것을 요구하는지 여부다. 지방법원은 이 질문을 중간 항소 대상으로 인정했고, 제9 순회 항소법원이 2024년 12월 이를 받아들여 2026년 2월 11일 구두변론이 열렸다. 지방법원 절차는 중지되어 있다. '동일한 복제물'은 많은 학습 데이터 주장이 기대는 축이므로 답은 Copilot을 넘어 중요하다. 더 넓은 AI와 저작권 문제는 별도로 다룬다.[1]
Microsoft의 AI 제휴와 플랫폼 지위는 모두 규제 당국의 관심을 받았고, 결과는 엇갈린다.[1]
| 기관 | 사안 | 결과 |
|---|---|---|
| 미국 연방거래위원회(FTC) | AI 개발사와 클라우드 제공자의 제휴에 대한 6(b) 조사, Microsoft-OpenAI 포함 | 2025년 1월 직원 보고서 발간. 연산 접근, 인재, 전환 비용, 정보 흐름에 대한 잠재적 우려를 지적. 시장 조사이며 판정이 아님[1] |
| 영국 경쟁시장청(CMA) | Microsoft-OpenAI 제휴 | 2025년 3월 결정: 영국 기업결합 규정상 조사 대상이 아님[1] |
| 영국 경쟁시장청(CMA) | Microsoft-Inflection 채용 및 라이선스 | 2024년 9월 1단계 승인[16] |
| 영국 경쟁시장청(CMA) | Microsoft 업무용 소프트웨어 생태계의 전략적 시장 지위 조사 | 2026년 5월 14일 디지털 시장·경쟁·소비자법 2024에 따라 개시, 작성 시점 진행 중. 조사 개시는 지정이나 결론이 아님[1] |
| European Commission | Teams와 Microsoft 365·Office 365의 번들링 | 2025년 9월 12일 구속력 있는 약속 수용: 유럽경제지역 내 Teams 없는 저가 제품군, 전환권, 상호운용성, 데이터 이식성. 해당 절차에서 위반 판정이나 과징금 없음[1] |
두 건의 종결된 기업결합 사안은 흔히 열린 조사로 인용되지만 그렇지 않다. 또 이 사안들은 2026년 4월 OpenAI 계약 개정보다 앞서 있으므로, 검토된 형태로는 더 이상 존재하지 않는 계약을 평가한 것이다.[1]
Microsoft는 2020년 2030년까지 탄소 네거티브, 수자원 포지티브, 폐기물 제로를 달성하겠다고 약속했다.[2] 앞서 설명한 데이터센터 확장으로 이 목표는 실질적으로 더 어려워졌다.
2026년 7월 발간된 Environmental Sustainability Report(2025 회계연도 대상)는 Scope 1, 2, 3 배출량이 전년 대비 25% 늘었다고 밝혔다. 증가의 주된 원인은 데이터센터 확장과, 추가성이 없고 분리된 재생에너지 인증서를 세지 않고 대신 청정 전기를 전력망에 더하는 프로젝트를 택한 결정이다. Scope 2 전력 배출은 1년 전 약 2%에서 회사 배출량의 13%로 늘었는데, 이는 전력 사용의 비례적 증가보다 회계 방식 변화에 따른 결과가 크다. 같은 보고서는 Microsoft가 연간 전 세계 전력 소비량의 100%를 재생에너지로 맞췄고, 1,400만 세제곱미터 이상의 물을 보충해 처음으로 전 세계 취수량을 넘었다고 밝혔다.[1]
연간 매칭은 시간대별 매칭이 아니다. 모든 시설이 모든 시간에 청정 전기를 썼다는 뜻이 아니다. 물 보충은 포트폴리오 단위의 회계 척도이며, 특정 데이터센터 인근의 지역 수자원 사정을 나타내지 않는다. 두 수치 모두 회사가 보고한 것이고, 재무제표처럼 독립 감사를 받지는 않았다.[1]
각주·출처 40개
- ↩1 ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9 ↩10 ↩11 ↩12 ↩13 ↩14 ↩15 ↩16 ↩17 ↩18 ↩19 ↩20 ↩21 ↩22 ↩23 ↩24 ↩25 ↩26 ↩27 ↩28 ↩29 ↩30 ↩31 ↩32 ↩33 ↩34 ↩35 ↩36 ↩37 ↩38 ↩39 ↩40 ↩41 ↩42 ↩43 ↩44 ↩45 ↩46 ↩47 ↩48 ↩49 ↩50 ↩51 ↩52 ↩53 ↩54 ↩55 ↩56 ↩57 ↩58 ↩59 ↩60 ↩61 ↩62 ↩63 ↩64 ↩65 ↩66 ↩67 ↩68 ↩69 ↩70 ↩71 ↩72 ↩73 ↩74 ↩75 ↩76 ↩77 ↩78 ↩79 ↩80 ↩81 ↩82 ↩83 ↩84 ↩85 ↩86 ↩87 ↩88 ↩89 ↩90 ↩91 ↩92 ↩93 ↩94 ↩95 ↩96 ↩97 ↩98 ↩99 ↩100 ↩101 ↩102 ↩103 ↩104 ↩105 ↩106 ↩107 ↩108 ↩109 ↩110 ↩111 ↩112 ↩113 ↩114 ↩115 ↩116 ↩117 ↩118 ↩119 ↩120 ↩121 ↩122 ↩123 ↩124 ↩125 AI Wiki: Microsoft (2026-09-30 수정본) · CC BY 4.0 · 확인 2026-10-11
- ↩1 ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 Microsoft 2025 Annual Report · 확인 2026-10-11
- ↩1 ↩2 ↩3 The History of Microsoft: 1975 · 확인 2026-10-11
- ↩1 ↩2 Microsoft board names Satya Nadella as CEO · 확인 2026-10-11
- ↩1 ↩2 Microsoft 2025 annual shareholder meeting · 확인 2026-10-11
- ↩1 ↩2 ↩3 About Microsoft Research · 확인 2026-10-11
- ↩1 ↩2 ↩3 Mustafa Suleyman joins Microsoft to lead Microsoft AI, March 19, 2024 · 확인 2026-10-11
- ↩1 ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9 The next phase of the Microsoft-OpenAI partnership, April 27, 2026 · 확인 2026-10-11
- ↩1 Computer History Museum: MS-DOS and Word for Windows source code · 확인 2026-10-11
- ↩1 U.S. Department of Justice: United States v. Microsoft browser and middleware case · 확인 2026-10-11
- ↩1 Microsoft fiscal 2026 third-quarter earnings release · 확인 2026-10-11
- ↩1 ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9 ↩10 ↩11 ↩12 ↩13 ↩14 ↩15 ↩16 ↩17 ↩18 ↩19 ↩20 ↩21 ↩22 ↩23 Microsoft fiscal 2026 fourth-quarter earnings conference call, July 29, 2026 · 확인 2026-10-11
- ↩1 Microsoft workforce announcement, July 2026 · 확인 2026-10-11
- ↩1 Deep Residual Learning for Image Recognition · 확인 2026-10-11
- ↩1 Introducing CoreAI: Platform and Tools, January 13, 2025 · 확인 2026-10-11
- ↩1 ↩2 CMA: Microsoft/Inflection AI inquiry · 확인 2026-10-11
- ↩1 ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9 Microsoft AI: Building a hillclimbing machine, launching seven new MAI models, June 2, 2026 · 확인 2026-10-11
- ↩1 ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9 ↩10 Microsoft Build 2026 live coverage and announcements, June 2-3, 2026 · 확인 2026-10-11
- ↩1 ↩2 OpenAI forms exclusive computing partnership with Microsoft to build new Azure AI supercomputing technologies, July 22, 2019 · 확인 2026-10-11
- ↩1 ↩2 Microsoft and OpenAI extend their partnership, January 23, 2023 · 확인 2026-10-11
- ↩1 ↩2 ↩3 Microsoft and OpenAI evolve partnership to drive the next phase of AI, January 21, 2025 · 확인 2026-10-11
- ↩1 ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9 ↩10 ↩11 The next chapter of the Microsoft-OpenAI partnership, October 28, 2025 · 확인 2026-10-11
- ↩1 ↩2 ↩3 Introducing GitHub Copilot, June 29, 2021 · 확인 2026-10-11
- ↩1 ↩2 ↩3 GitHub Copilot is generally available to all developers, June 21, 2022 · 확인 2026-10-11
- ↩1 ↩2 ↩3 ↩4 GitHub Copilot is moving to usage-based billing, April 27, 2026 · 확인 2026-10-11
- ↩1 ↩2 GitHub Copilot plans and pricing · 확인 2026-10-11
- ↩1 ↩2 ↩3 Announcing Microsoft 365 Copilot general availability, September 21, 2023 · 확인 2026-10-11
- ↩1 ↩2 ↩3 Introducing Microsoft 365 Copilot, March 16, 2023 · 확인 2026-10-11
- ↩1 ↩2 Microsoft 365 Copilot plans and pricing, accessed September 25, 2026 · 확인 2026-10-11
- ↩1 ↩2 Introducing Copilot+ PCs, May 20, 2024 · 확인 2026-10-11
- ↩1 ↩2 Introducing Microsoft Security Copilot, March 28, 2023 · 확인 2026-10-11
- ↩1 ↩2 ↩3 Microsoft Security Copilot pricing · 확인 2026-10-11
- ↩1 ↩2 ↩3 Reinventing search with a new AI-powered Microsoft Bing and Edge, February 7, 2023 · 확인 2026-10-11
- ↩1 ↩2 Welcome home, agents: GitHub Agent HQ, October 28, 2025 · 확인 2026-10-11
- ↩1 ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9 ↩10 ↩11 Microsoft fiscal 2026 second-quarter earnings conference call, January 28, 2026 · 확인 2026-10-11
- ↩1 ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9 ↩10 Microsoft fiscal 2026 third-quarter earnings conference call · 확인 2026-10-11
- ↩1 Phi-3 Technical Report · 확인 2026-10-11
- ↩1 ↩2 Infinite scale: the architecture behind the Azure AI superfactory, November 12, 2025 · 확인 2026-10-11
- ↩1 ↩2 Maia 200: the AI accelerator built for inference, January 26, 2026 · 확인 2026-10-11
- ↩1 ↩2 LF AI and Data welcomes DeepSpeed, February 3, 2025 · 확인 2026-10-11