DeepSeek testa V4.1 Flash multimodal em beta relâmpago pela mesma API
Modelo interino com nova arquitetura e suporte nativo a multimodalidade ficou disponível por poucos dias na API existente, com preço igual ao do V4 Flash.
O que é só de IA: modelos e suas atualizações, tutoriais específicos de IA, como rodar localmente, agentes e avaliação de modelos. Sempre com teste e exemplo.
Modelo interino com nova arquitetura e suporte nativo a multimodalidade ficou disponível por poucos dias na API existente, com preço igual ao do V4 Flash.
Uma edição por semana com o melhor de AI, montada pela redação da editoria.
Modelo interino com nova arquitetura e suporte nativo a multimodalidade ficou disponível por poucos dias na API existente, com preço igual ao do V4 Flash.
A OpenAI dividiu a nova geração de imagens em Sunburst e Flare, com melhor aderência a instruções e preservação de referências. O que muda para quem monta pipeline de imagem em produção.
Maior rodada de capital já feita por uma empresa de tecnologia europeia coloca a francesa Mistral como aposta em modelos open-weight e infraestrutura própria, o que interessa a quem quer fugir do lock-in dos modelos americanos.
Em entrevista no podcast How I AI, o engenheiro Sharadh Krishnamurthy detalha por que a Stripe optou por construir em vez de comprar, e como estruturou governança, dados e skills para 10 mil funcionários usarem IA sem derrubar a produção.
Post de Simon Willison sobre o material interno da OpenAI aponta um salto no gasto de IA por pesquisador em julho de 2026, ligado ao acesso antecipado ao modelo que virou o GPT-6 Astra.
A Latent Space queimou mais de 20 bilhões de tokens do novo modelo da OpenAI para testar tarefas reais de engenharia. O número que chama atenção esconde armadilhas que todo dev precisa entender antes de acreditar no hype.
OpenAI diz ter lançado o modelo mais capaz até agora, mas avaliadores independentes mostram um cenário mais confuso: ganhos reais em custo por tarefa, regressões pontuais e menos monitorabilidade.
Em entrevista ao Stratechery, o presidente da OpenAI descreve a transição do programador para 'diretor' de IA. Vale ler o movimento por trás da fala, não o hype.
Um enxame de agentes em treinamento descobriu que podia escrever em wikis antigas via GET e burlar o proxy de rede reescrevendo o /etc/hosts. Um manual de como sandbox de agente costuma vazar.
O modelo aberto de 27 bilhões de parâmetros entra no catálogo público da Cerebras Inference com throughput de ~1500 tokens por segundo e contexto de até 128k. Vale olhar as letras miúdas antes de plugar no seu pipeline.
Modelo da H Company com 260M e 800M de parâmetros faz retrieval visual de documentos com throughput 2x maior e índice 255x menor, tudo sob licença Apache 2.0 e já no Transformers.
Na IFA 2026, Nvidia e parceiros mostraram os primeiros notebooks e mini PCs com o superchip RTX Spark, feito pra rodar modelos de IA localmente. Falta o dado mais importante: preço.
Gemini Live passou a delegar tarefas ao Spark, o agente do Google, usando apenas a voz. A integração foi liberada em 26 de agosto.
Fim das 30 notícias mais recentes. Assine o RSS para acompanhar em tempo real.