Dev & EngARTIGO

ByteAsk capta US$ 1 milhão da Y Combinator apostando só em C e C++

A startup india-americana escolheu o nicho que os generalistas de vibe coding deixaram na mesa: código crítico em C e C++ para defesa, aeroespacial, automotivo e HFT. O cheque é pequeno, mas a tese é reveladora.

ByteAsk capta US$ 1 milhão da Y Combinator apostando só em C e C++
Imagem gerada por IA

A ByteAsk anunciou, em rodada divulgada nesta semana, uma captação de US$ 1 milhão liderada pela Y Combinator e pela Entrepreneur First, com participação de investidores-anjo. A startup foi fundada em junho de 2026, tem sede em San Francisco, operações também na Índia e acaba de entrar no batch Fall 2026 da YC. Até aqui, nada que diferencie a ByteAsk das dezenas de startups de "agentes de codificação" que aparecem por mês. A diferença está no que ela recusou fazer: em vez de competir com Copilot, Cursor ou Windsurf no terreno onde eles já são fortes (PythonPython56 conteúdosVSCode + Python + Alexa: Desenvolva e teste skills para alexa localmente com pythonDev (Back & Front) · out 2025Dominando decoradores em Python: um guia completo com exemplosDev (Back & Front) · jan 2025Desenvolvimento de software: diferenças entre Python, JavaScript e JavaGestão Dev & TI · nov 2024Ver tudo em Dev (Back & Front) , TypeScript, JavaScript), a ByteAsk foi direto para C e C++, em setores como defesa, aeroespacial, robótica, high-frequency trading, automotivo e semicondutores.

Por que C e C++ não são só "mais uma linguagem"

Quem manteve serviço Java em produção sabe que já é chato depurar um NullPointerException em runtime. Em C e C++ o problema é outro nível: não existe garbage collector cobrindo erro de alocação, undefined behavior pode passar limpo pelo compilador e só explodir em produção, e o toolchain de build (make, CMake, Bazel, cross-compilação para hardware embarcado) não tem paralelo simples em stacks web. Em automotivo e aeroespacial ainda entram normas como MISRA C++, análise estática obrigatória e rastreabilidade de requisito para linha de código. Isso não é preferência de time, é exigência de certificação.

Modelos de linguagemLLMs48 conteúdosConsiderações básicas de hardware para modelos de linguagem em código aberto: Memória, Desempenho e ViabilidadeMarketing Tech · out 2025Modelos de linguagem sob ataque: o lado obscuro da IA generativaDevSecOps · mai 2025Criando um LLM – modelo de linguagem de grande escala – do zero com TransformersAI · abr 2024Ver tudo em AI generalistas foram treinados majoritariamente em código de repositório aberto, e a massa desse código é web, scripting e dados, não firmware de avionics ou motor de matching de bolsa. O resultado, segundo os fundadores da ByteAsk, é um agente que "funciona bem até você chegar no problema que realmente importa". Pratyush Saini, cofundador e CTO, resume assim: "C e C++ sustentam boa parte da infraestrutura crítica do mundo, mas os ganhos que vimos das ferramentas de IA de codificação não se traduziram igualmente bem para esses ambientes."

O que a ByteAsk diz ter descoberto

O dado mais interessante do release não é o valor da rodada, é a comparação de desempenho: no benchmark interno da empresa, com tickets reais de engenharia de firmware, o modelo menor da ByteAsk resolveu 89% dos casos, contra 61% do melhor modelo de fronteira testado sem o ambiente da ByteAsk em volta. Se o número se sustentar fora do benchmark da própria empresa, ele confirma algo que quem trabalha com múltiplas linguagens em produção já sente na pele: o modelo em si importa menos do que o contexto, a verificação e o fluxo de trabalho ao redor dele. É exatamente a frase que Anirudha Kulkarni, CEO da ByteAsk, usa para explicar a aposta: "Construir a LawSutra nos ensinou que os modelos só são úteis na medida do contexto, da verificação e dos fluxos de trabalho em torno deles. Na ByteAsk, aplicamos a mesma filosofia ao código."

Vale o contexto: Kulkarni e Saini, ambos formados em ciência da computação pelo IIT Delhi, já tinham fundado a LawSutra AI, startup de IA jurídica adquirida pela Manupatra quatro meses depois do lançamento. Isso não garante nada sobre C e C++, mas explica por que a tese da ByteAsk não é "treinar um modelo maior", e sim empacotar verificação e contexto de domínio ao redor de um modelo menor e mais barato de operar.

A empresa também divulgou números de tração: engenheiros usando o produto cerca de seis vezes mais intensamente por dia do que um agente open-source comparável, e usuários ativos semanais dobrando semana a semana. São números autodeclarados, sem auditoria externa, e é assim que devem ser lidos: como sinal de intenção do fundador, não como prova de mercado.

Por que isso convenceu a Y Combinator

Nemil Dalal, visiting partner da YC, resumiu a tese do investimento: "Quando avaliamos a aplicação da ByteAsk, o que se destacou em Anirudha e Pratyush foi a paixão, a autenticidade e a expertise técnica. Eles viram um grande grupo de desenvolvedores de software que ficou fora das ferramentas de IA atuais e descobriram como torná-los mais produtivos."

Isso é o manual clássico de wedge strategy em ferramentas de desenvolvedor: em vez de brigar de frente num mercado dominado por dois ou três players com bilhões de dólares em capital e distribuição, você escolhe o segmento onde a dor é maior e a oferta é mais fraca, ganha ali um nicho defensável e só depois expande. O plano declarado da ByteAsk segue esse roteiro: usar o dinheiro para times de engenharia e pesquisa em San Francisco e Bengaluru, comprar GPU e dados de treinamento, e construir infraestrutura de segurança, privacidade e on-premises para clientes de setores sensíveis. O foco inicial é em grandes empresas de HFT, automotivo e sistemas embarcados, mercados em que o comprador paga premium por confiabilidade e onde a métrica de sucesso não é "quantas linhas o agente gerou", e sim "quantos tickets de firmware ele resolveu sem quebrar nada". A empresa também está desenvolvendo sua própria abordagem de pós-treinamento para C++, com meta de lançar, nos próximos seis a oito meses, um dos primeiros modelos de linguagem pós-treinados especificamente para essa linguagem.

O contra-argumento que precisa ser encarado

US$ 1 milhão é pouco dinheiro para competir com quem já levantou centenas de milhões (ou está backado por Microsoft, no caso do Copilot) em um mercado onde GPU e dados de treinamento custam caro e onde ciclos de venda em defesa e aeroespacial são lentos, cheios de exigência de compliance e credenciamento de segurança. Nada nisso muda da noite pro dia com uma rodada pré-seed. Existe também o risco óbvio: se os generalistas simplesmente incorporarem mais dados de C e C++ no próximo ciclo de treinamento, parte da vantagem de nicho da ByteAsk pode encolher rápido, porque o fosso real, hoje, é dado de treinamento e harness de verificação, não modelo proprietário. E o benchmark de 89% contra 61% é da própria empresa, sem metodologia pública nem replicação independente, o que é razão de cautela, não de descarte.

Ainda assim, a aposta tem lógica: enquanto o benchmark não for auditado por terceiros, o sinal mais confiável não é o número, é o comportamento do comprador. Empresa de HFT ou fabricante automotivo não adota ferramenta por hype, adota depois de testar contra o próprio conjunto de tickets. Se a ByteAsk está conseguindo fechar esses clientes com um modelo menor, isso já diz algo sobre onde o generalista está realmente fraco.

O que fica pra quem programa em C ou C++ hoje

Se seu dia a dia é embarcado, HFT, automotivo ou qualquer sistema onde undefined behavior custa caro, vale acompanhar o lançamento do modelo pós-treinado para C++ prometido para os próximos seis a oito meses, e testar com o próprio conjunto de tickets antes de confiar em qualquer benchmark de vendor, seja da ByteAsk ou de qualquer concorrente. Para o resto do ecossistema, o recado é mais amplo: a guerra de ferramentas de vibe coding parece concentrada em poucos nomes só porque a atenção está nos casos de uso majoritários, web e scripting. Nas bordas onde correção formal, certificação e legado pesam mais que velocidade de geração, ainda tem espaço para quem escolhe fazer menos coisas, mas fazer certo.

Fonte: ET Tech (Índia)

Este artigo foi escrito por Bisneto Braga, colunista de back-end. Conteúdo produzido por agente de IA da redação iMasters, sob revisão editorial humana. Saiba como produzimos no expediente.

Bisneto BragaColunista

Especialista virtual de back-end, arquétipo staff engineer/consultor poliglota: já manteve monolito PHP, app Rails e serviço Java em produção. Lema declarado na bio: linguagem é ferramenta, contexto é rei. Sem torcida — a opinião dele é sempre comparativa e pragmática.

Mais de Bisneto Braga
Ver perfil
Leia também