Microsoft – Build 2026 – MAI-Thinking-1, seu novo modelo de raciocínio de “apenas” 35 bilhões de parâmetros ativos.

A Microsoft acaba de anunciar no Build 2026 o MAI-Thinking-1, seu novo modelo de raciocínio de “apenas” 35 bilhões de parâmetros ativos.

O grande pulo do gato? O foco total é em eficiência e baixo custo de tokens. Nada de gastar fortunas à toa. Nos testes cegos, os avaliadores preferiram ele ao Sonnet 4.6, e ele empatou com o Opus 4.6 em habilidades de código no SWE Bench Pro.

Isso prova que modelos médios e hiperotimizados são o futuro real do desenvolvimento e da IA no dia a dia. Desperdício de VRAM e infraestrutura pesada estão caindo em desuso. Eficiência é o novo poder.

Em primeiro lugar, inteligência verdadeiramente sua. Com a Plataforma de Agentes da Microsoft, impulsionada pelo seu contexto e pela inteligência do Microsoft IQ, você pode criar seu agente no GitHub, implantá-lo no Microsoft Foundry e otimizá-lo automaticamente com os modelos mais adequados para a tarefa. Baseie-o na sua inteligência e no conhecimento global e acesse-o pelo Microsoft Teams, M365 ou em qualquer lugar onde sua equipe trabalhe. Projetada para reduzir a necessidade de fazer concessões entre contexto e governança, segurança e velocidade ou modelos e ferramentas.

Em segundo lugar, a pilha completa construída do seu jeito. Você deve poder construir da maneira que quiser, com as ferramentas, modelos e fluxos de trabalho que escolher, e tornar isso realidade. Isso se estende além da plataforma de agentes para toda a pilha. Do silício ao sistema operacional, das ferramentas de desenvolvimento à nuvem — e tudo começa com o Windows. Não o Windows para “desenvolvedores Windows”. O Windows para desenvolvedores, ponto final. Estamos trazendo uma nova configuração de desenvolvedor que oferece mais flexibilidade, uma experiência de terminal e shell inteligente e fluida, isolamento local para agentes, novos recursos do Subsistema Windows para Linux e opções poderosas para executar tudo em sua máquina local.

Em terceiro lugar, temos o que vem a seguir , onde os sistemas agentes passam do código para o progresso humano, ampliando o que cientistas e pesquisadores podem alcançar. Novas fronteiras na ciência e na computação que começam com a mesma plataforma de desenvolvimento subjacente.

Juntos, os desenvolvedores obtêm um ecossistema multimodal, do seu laptop à nuvem, para que você possa construir na vanguarda sem abrir mão do controle e da habilidade que realmente tornam o trabalho seu.

E como sempre, tudo começa com o desenvolvedor. Vamos lá.

Agentes que conhecem você, seu negócio e o mundo.

À medida que os modelos se tornam mais capazes e acessíveis, o diferencial para qualquer organização deixa de ser o acesso à inteligência e passa a ser a sua propriedade. Como a sua experiência, os seus dados e a sua forma de trabalhar se transformam num sistema que aprende continuamente e gera melhores resultados? O objetivo é um ecossistema que dê às empresas a sua própria autonomia, e não um que canalize o valor de volta para um consultor ou para o criador do modelo.

Seus agentes devem refletir a sua maneira de pensar e agir, desde a sua lógica de negócios e conhecimento institucional até os seus fluxos de trabalho.

Tudo começa com o contexto. O Microsoft IQ , disponível hoje para o público em geral no GitHub Copilot, Microsoft Foundry e Copilot Studio, é uma nova camada de contexto que fundamenta os agentes tanto no conhecimento do mundo real quanto no conhecimento da empresa. O Work IQ é a camada de inteligência do ambiente de trabalho para os agentes, capturando como o trabalho realmente acontece no Microsoft 365, nos sistemas organizacionais e em fontes externas: pessoas, e-mails, documentos, reuniões e como eles se conectam. As APIs do Work IQ, disponíveis a partir de 16 de junho, fornecem acesso programático a essa camada de inteligência e oferecem aos agentes o contexto necessário para trabalharem com eficácia em sua organização. O Fabric IQ fornece uma base semântica compartilhada sobre dados de negócios estruturados. O Foundry IQ integra tudo e permite o planejamento de recuperação de informações tanto no conhecimento da empresa quanto na web em tempo real.

A Web IQ , anunciada hoje, é a mais recente adição à família : a base mais rápida e realista que você pode oferecer aos seus agentes. Uma plataforma de busca na web com inteligência artificial, independente de modelo e nativa do MCP, que retorna trechos relevantes quase 2,5 vezes mais rápido que a melhor alternativa disponível.

Também estamos analisando como esse contexto se aplica a novos formatos, especificamente agentes autônomos sempre ativos. O Microsoft Scout é um novo agente pessoal para o trabalho que estamos lançando hoje para os clientes da Frontier. Construído com base no OpenClaw e no WorkIQ, o Microsoft Scout entende como você trabalha, usa as ferramentas que você já utiliza, como o Teams e o Outlook, e lida proativamente com tarefas como preparação de reuniões, conflitos de agenda e tarefas rotineiras sem que você precise pedir. Em breve, compartilharemos mais informações à medida que expandirmos os recursos do Microsoft Scout e o implementarmos de forma mais ampla.

Na camada de modelos, a equipe de Superinteligência de IA da Microsoft lançou uma família de sete novos modelos internos, começando com o MAI-Thinking-1 – o primeiro modelo de raciocínio da Microsoft AI. Treinado do zero, sem qualquer destilação, com dados de nível empresarial, limpos e com licença comercial, você pode usá-los com confiança.

É um modelo de tamanho médio, com 35 bilhões de parâmetros ativos e uma janela de contexto de 256 mil, projetado para alta eficiência e desempenho, mas, principalmente, com baixo custo em tokens. Em um teste cego, avaliadores independentes o preferiram ao Sonnet 4.6 [1], e ele se equipara ao Opus 4.6 em habilidades de codificação no SWE Bench Pro [2]. O MAI-Thinking-1 foi projetado para ser bom em instruções complexas de múltiplas etapas, raciocínio de contexto longo e geração de código, e agora está disponível em versão prévia privada no Foundry.

Mas esse não é o único modelo novo. O MAI-Image-2.5 e sua variante em Flash são os primeiros modelos da Microsoft a oferecer suporte tanto para conversão de texto em imagem (3º lugar no ranking do Arena AI) quanto para conversão de imagem em imagem (2º lugar no ranking do Arena AI, superando o Nano Banana 2). Eles são especialmente úteis em fluxos de trabalho criativos, quando você precisa de ajuda para transformar um conceito em realidade ou aprimorar imagens já existentes. Esses modelos já estão disponíveis no PowerPoint, sendo implementados no OneDrive e, hoje, chegam ao Foundry com a melhor relação custo-benefício do mercado.

Há também outros novos membros da família MAI: o MAI Transcribe 1.5 combina precisão de última geração em 43 idiomas, com streaming em breve. O MAI-Voice-2 e sua variante em Flash agora estão disponíveis em mais de 15 idiomas adicionais, com novas opções de voz. E o MAI-Code-1, nosso modelo de codificação com inferência eficiente otimizado para o GitHub, agora está disponível no Copilot e no VS Code.

A escolha dos desenvolvedores não se limita ao nosso catálogo. Os modelos MAI também estarão disponíveis no Fireworks AI, Baseten e Open Router. E o Fireworks AI agora está disponível para todos no Foundry , oferecendo aos desenvolvedores uma experiência de plataforma única com governança corporativa e residência de dados no Azure, independentemente do modelo escolhido.

Para organizações prontas para internalizar verdadeiramente a inteligência artificial, o Frontier Tuning aplica aprendizado por reforço dentro dos limites de conformidade, permitindo que os agentes aprendam como o negócio realmente funciona. Usando seus próprios dados, conhecimento do domínio e fluxos de trabalho, o resultado é um ciclo que se aprimora à medida que os agentes trabalham. Disponível em pré-visualização privada hoje mesmo.

E a segurança e a governança abrangem todo o sistema. O Agent 365 para agentes locais estende o Entra, o Defender e o Purview para um único plano de controle, permitindo observar, governar e proteger os agentes em toda a sua infraestrutura, independentemente de onde estejam hospedados ou da estrutura em que foram construídos. É assim que você desenvolve com rapidez, mantendo o controle.

Paralelamente, existe uma pilha de confiança aberta e completa para agentes de IA em qualquer estrutura, ancorada em dois projetos de código aberto: o Adaptive Spec-driven Scoring for Evaluation and Regression Testing (ASSERT) para avaliação de segurança orientada por políticas e o Agent Control Specification para padronizar onde e como aplicar controles no ciclo do agente.

Para reforçar ainda mais nossa defesa, contamos com o Codinome MDASH . Nosso novo sistema de segurança multimodelo baseado em agentes implanta mais de 100 agentes para encontrar vulnerabilidades exploráveis, analisando o fluxo de dados, a lógica de negócios e as cadeias de exploração, com correções contextuais entregues diretamente no Portal do Defensor.

O pacote completo, do seu jeito.

Quando pensamos em trabalho na era da atuação colaborativa, isso exige uma plataforma de inteligência ubíqua que abranja nuvem e borda. Mas, como desenvolvedor, como construir esses sistemas colaborativos complexos mantendo o controle total? Isso significa manter o fluxo de trabalho em vez de esperar por ferramentas e executar experimentos em minutos em vez de horas.

Tudo começa no silício, e é aí que entra o Surface RTX Spark Dev Box – ele foi projetado para cargas de trabalho contínuas: tarefas de treinamento de longa duração, pipelines de IA com agentes e ajuste fino de modelos locais.

Equipado com NVIDIA RTX Spark, oferece até um petaflop de computação de IA e 128 GB de memória unificada, capaz de executar LLMs de até 120 bilhões de parâmetros com até 1 milhão de tokens de contexto usando agentes localmente, sem instâncias de GPU na nuvem [3]. O Windows Services for Linux (WSL) 2, com passagem de GPU nativa e suporte completo a CUDA, vem pré-configurado para desenvolvedores, com Visual Studio Code, GitHub Copilot e muitas outras ferramentas pré-instaladas. O Surface RTX Spark Dev Box estará disponível ainda este ano nos EUA, através do Microsoft.com.

Na camada do sistema operacional, a Microsoft está transformando o Windows em um ambiente de execução nativo para agentes. O Microsoft Execution Containers (MXC) , agora em versão prévia, oferece aos desenvolvedores e administradores de TI uma maneira mais simples de criar ambientes isolados de nível empresarial para agentes, com o isolamento imposto pelo próprio sistema operacional. Descreva seus requisitos uma única vez e o Windows os aplicará em todos os locais onde seus agentes forem executados.

Essa tecnologia agora está sendo usada pelo OpenClaw no Windows , permitindo a execução de fluxos de trabalho com várias etapas dentro desses limites impostos pelo sistema operacional. O runtime seguro OpenShell da NVIDIA para agentes autônomos usa MXC e adiciona gerenciamento de políticas, roteamento de inferência e ofuscação de informações pessoais identificáveis ​​(PII). Juntas, essas funcionalidades oferecem aos desenvolvedores um ambiente seguro para o desenvolvimento e a implantação de agentes e fornecem às equipes de TI as ferramentas de governança necessárias em dispositivos locais e ambientes de nuvem.

E quando os agentes migrarem para a nuvem, os agentes hospedados no Foundry Agent Service , em versão prévia, fornecerão o mesmo modelo em escala: ambientes isolados instantâneos por sessão, execução isolada, memória persistente e escalabilidade elástica. Pense nisso como o elemento primitivo para agentes, assim como os contêineres foram para aplicativos nativos da nuvem.

Os fluxos de desenvolvimento agentivos, seja no IDE ou na linha de comando, nos ajudam a escrever código mais rápido do que nunca, mas isso é apenas uma parte da construção de software.

aplicativo GitHub Copilot , agora em versão prévia, traz o desenvolvimento orientado a agentes para uma experiência nativa em desktops — e para um público muito maior. Comece com uma ideia, um problema existente ou um pull request, orquestre várias sessões de agentes em paralelo e mantenha as alterações em andamento durante a revisão, integração contínua e mesclagem. Cada sessão usa árvores de trabalho do Git, mantendo o trabalho separado. O Copilot cuida da execução, enquanto os desenvolvedores mantêm o controle.

Os desenvolvedores podem gerar aplicativos em segundos, mas colocar esses aplicativos em produção ainda exige a integração de bancos de dados, APIs, autenticação e infraestrutura.

Na camada de plataforma, o Rayfin , agora em versão prévia, resolve esse problema. Ele traz um backend gerenciado como serviço para o Microsoft Fabric, definido por meio de fluxos de trabalho baseados no GitHub, para que os desenvolvedores possam migrar do protótipo para a produção sem precisar gerenciar a infraestrutura. A integração com o Replit cria um caminho rápido do protótipo para a implantação de nível empresarial com governança desde o primeiro dia. E à medida que os aplicativos com agentes escalam, o Azure Horizon DB oferece desempenho e confiabilidade para atender aos seus requisitos de banco de dados mais exigentes. É um serviço PostgreSQL totalmente gerenciado no Azure que oferece mais de 3 vezes a taxa de transferência de configurações autogerenciadas comparáveis ​​em testes internos.

O futuro pertence aos construtores.

Da mesma forma que agentes de longa duração ajudaram a redefinir o desenvolvimento de software e o papel do desenvolvedor, novos agentes ajudarão a mudar a pesquisa e o desenvolvimento, bem como o que os cientistas podem alcançar.

O Microsoft Discovery já está disponível para o público em geral. Construído na plataforma Azure, ele oferece aos pesquisadores uma plataforma de IA de nível empresarial para todo o fluxo de trabalho científico. A BHP está usando-o para encontrar soluções para a lixiviação de cobre em meses, em vez de anos. A Syensqo está acelerando a pesquisa e o desenvolvimento de semicondutores. A GSK está aprimorando a descoberta de medicamentos. Além disso, um aplicativo local gratuito do Discovery foi anunciado para a comunidade científica em geral. Ele está disponível em versão prévia e requer apenas uma conta do GitHub Copilot.

Finalmente, nosso chip de computação quântica de próxima geração, Majorana 2, representa um grande passo rumo à escalabilidade: uma vida útil média de qubit de 20 segundos, com instâncias de até um minuto, confiabilidade 1.000 vezes maior que a da geração anterior e um caminho para um milhão de qubits em um chip que cabe na palma da sua mão. Com a ajuda da IA ​​agente, alcançaremos uma máquina quântica escalável até 2029.

***

As plataformas não mudam sozinhas; os desenvolvedores as constroem para o futuro. Hoje, o objetivo é oferecer a você mais ferramentas para criar.

Esses são apenas alguns dos anúncios da Build. Estamos animados para nos conectar com todos vocês que participarão virtualmente e presencialmente para palestras, imersões em código, sessões de programação e muito mais. Muitas sessões também estarão disponíveis sob demanda.

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *