Agora
IA & TechCEO da Shopify, que exigiu IA antes de novas contratações em 2025, agora critica trabalho de IA sem revisãoTipografiaFontBase publica ranking diário das fontes mais ativadas, com Helvetica, Mont e Gotham no topoEventosHomo Faber 2026 leva mais de 700 objetos de 500 artesãos a Veneza, com direção artística de Es DevlinReferênciasHomme Plissé Issey Miyake transforma The Snail, de Matisse, em roupas plissadas e dança na Tate ModernEventosExposição Pluriforma leva arte concreta e móveis de Geraldo de Barros a Botucatu até 4 de outubroReferênciasAssimply monta a mesa e o espelho Dominó com cerâmica descartada do Rio e alumínio recicladoEventosIbehas abre na Barra Funda uma galeria de arte sonora com 11 obras e cerca de 200 caixas de somReferênciasEstúdio Campana e Perkins&Will assinam a Sala Pedra Preta, lounge do Itaú em GuarulhosEventosBDA prorroga o upload de projetos até 22 de setembro, com categoria para design feito para foraEventosIMS Paulista abre exposição com cerca de 400 obras de Fernando Lemos no centenário do artistaIA & TechCEO da Shopify, que exigiu IA antes de novas contratações em 2025, agora critica trabalho de IA sem revisãoTipografiaFontBase publica ranking diário das fontes mais ativadas, com Helvetica, Mont e Gotham no topoEventosHomo Faber 2026 leva mais de 700 objetos de 500 artesãos a Veneza, com direção artística de Es DevlinReferênciasHomme Plissé Issey Miyake transforma The Snail, de Matisse, em roupas plissadas e dança na Tate ModernEventosExposição Pluriforma leva arte concreta e móveis de Geraldo de Barros a Botucatu até 4 de outubroReferênciasAssimply monta a mesa e o espelho Dominó com cerâmica descartada do Rio e alumínio recicladoEventosIbehas abre na Barra Funda uma galeria de arte sonora com 11 obras e cerca de 200 caixas de somReferênciasEstúdio Campana e Perkins&Will assinam a Sala Pedra Preta, lounge do Itaú em GuarulhosEventosBDA prorroga o upload de projetos até 22 de setembro, com categoria para design feito para foraEventosIMS Paulista abre exposição com cerca de 400 obras de Fernando Lemos no centenário do artista

Relatório da Mozilla mede Kimi K3 e outros modelos abertos chineses a poucos pontos dos fechados de ponta

Atualizado em 21 Sep 2026

Os números do relatório da Mozilla sobre onde os modelos abertos alcançam os fechados e onde não.

O que é o relatório

É a versão 1.1 de uma avaliação recorrente da Mozilla, que substitui a primeira edição, de julho. Os dados vão até 1º de setembro de 2026. No texto, “aberto” quer dizer pesos disponíveis para download: dos 16 lançamentos abertos que o relatório analisa, nenhum publica a receita de dados que a definição de código aberto da OSI pede. A Ars Technica recebeu o material antes da publicação e noticiou em 15 de setembro.

O placar geral

O Artificial Analysis Intelligence Index (versão 4.1.1) combina nove avaliações, entre elas Terminal-Bench 2.1, Humanity’s Last Exam e GPQA Diamond. Os primeiros colocados em 1º de setembro:

| Modelo | Tipo | Índice | Preço por milhão de tokens (entrada/saída) | |—|—|—|—| | Claude Opus 5 | fechado | 63,0 | US$ 5 / 25 | | Claude Fable 5 | fechado | 62,1 | US$ 10 / 50 | | GPT-5.6 Sol | fechado | 61 | US$ 5 / 30 | | Grok 4.6 | fechado | 61 | US$ 2 / 6 | | Kimi K3 (Moonshot AI) | aberto | 60 | US$ 3 / 15 | | GLM-5.3 (Z.ai) | aberto | 60 | US$ 1,15 / 3,50 | | Qwen 3.8 Max (Alibaba) | aberto | 58 | US$ 2 / 6 | | GLM-5.3 Flash (Z.ai) | aberto | 57 | US$ 0,075 / 0,25 | | GPT-5.6 Terra | fechado | 57 | US$ 2 / 12 |

O Muse Spark 1.2, da Meta, também marca 57, mas os pesos foram prometidos e ainda não publicados.

Contra o Fable 5, o K3 fica 2,1 pontos atrás a 30% do preço de entrada; contra o Opus 5, líder, fica 3 pontos atrás a 60%. O relatório faz duas ressalvas. O Fable 5 e o Sol são pontuados como sistemas com proteções e alternativas de reserva, e o K3 como modelo puro. E o preço por token engana: por tarefa concluída do índice, o K3 sai por cerca de US$ 0,86 e o Sol por US$ 1,23, uns 30% a menos, diferença menor que a do preço de lista, porque o K3 é mais lento e gasta mais tokens. A Artificial Analysis anunciou a versão 4.2 do índice em 4 de setembro, depois do recorte usado.

Quanto tempo de atraso

Duas medidas chegam perto de quatro meses:

Epoch Capabilities Index. Fable 5 e Opus 5 marcam 162, o K3 marca 157. A Epoch AI calcula que, desde janeiro de 2026, a diferença média entre o melhor aberto e o melhor fechado é de 8 pontos, cerca de quatro meses, e diz que o número pode estar subestimado: abertos otimizam mais para benchmark, e fechados não lançados ficam fora da conta. – Horizonte de tarefas do METR. Um ajuste da Mozilla sobre os dados brutos do METR dá atraso de cerca de 4,4 meses. O tamanho da tarefa que os modelos completam dobra a cada 3,9 meses nos abertos e a cada 5,5 meses nos fechados. A própria Mozilla chama o cálculo de reprodução simplificada, e o METR estima margens de erro de cerca de duas vezes.

Daí sai a regra de uso proposta no relatório: tarefas de menos de 8 horas qualquer um resolve, e acima de 12 horas nenhum resolve. O prêmio de cerca de cinco vezes por tarefa só compensa nessa faixa, quando quatro meses de vantagem valem o custo.

Onde cada lado vence

Código de interface: o K3 estreou em 1º lugar na Frontend Code Arena do LMArena, com 1679 de Elo. – Trabalho em terminal: o relatório classifica como disputado: 88,3 do K3 contra 88,8 do Sol no Terminal-Bench 2.1. No FrontierSWE, que mede a resolução de tickets reais de software, o Fable 5 marca 86,6 e o K3 81,2. – Trabalho profissional especializado: o Fable 5 abre 92 de Elo sobre o K3 no GDPval-AA v2, a maior distância entre os testes comuns aos dois. – Contexto longo: buscando vários trechos em 1 milhão de tokens, o Gemini 3.1 Pro acerta 89% e o DeepSeek V4-Pro, 41%. – Mesmo ambiente, preços diferentes: no Terminal-Bench 2.1 rodado pela vals.ai com a mesma estrutura para todos, o GLM 5.2 marca 67,79% a US$ 0,43 por tarefa e o Claude Opus 4.7, 68,54% a US$ 1,98.

O relatório avisa que a maior parte desses placares por tarefa vem de testes dos próprios fabricantes e deve ser lida como indicativa. À Ars Technica, o CTO da Mozilla, Raffi Krikorian, resumiu onde o fechado ainda cobra caro: “trabalho profissional especializado, recuperação intensa de informação e contexto longo”.

Quem mediu

A Mozilla se declara parte interessada: defende publicamente a IA aberta, e o braço de investimentos Mozilla Ventures tem participação em empresas citadas no relatório. O documento também informa que usou IA na edição e na redação, e que cada número foi conferido por uma pessoa na fonte original.

Ficha

Designer Mozilla
Classificação Inteligência artificial, Modelos abertos, Benchmarks
Tipo Relatório da Mozilla sobre IA de código e pesos abertos
Fonte oficial Mozilla
Fonte oficial Mozilla
Também consultados Epoch AI · Ars Technica · Jeremy Hsu

Continue lendo

IA & Tech23 set 2026Mooni viu em X (conta de Tobi Lütke)

CEO da Shopify, que exigiu IA antes de novas contratações em 2025, agora critica trabalho de IA sem revisão

Em abril de 2025, o CEO da Shopify, Tobi Lütke, publicou no X um memorando interno que tornava o uso de IA uma expectativa básica e exigia que as equipes mostrassem por que a IA não daria conta antes de pedir mais gente. Em 15 de setembro de 2026, no podcast The Knowledge Project, ele disse que funcionários passam adiante trabalho feito por IA sem revisar e que, na empresa, isso ganhou o nome de "slop grenade". Entre uma fala e outra, a Shopify passou de cerca de 8.100 para 7.600 funcionários.

Ler o post
IA & Tech18 set 2026Mooni viu em Fast Company

Cadeira infantil impressa em 3D da MakeGood vence design acessível do Innovation by Design 2026

A MakeGood, organização sem fins lucrativos de Nova Orleans, venceu a categoria de design acessível do Innovation by Design Awards 2026, da Fast Company, com o Toddler Mobility Trainer, cadeira de mobilidade infantil de código aberto impressa em 3D. Whirlpool, Tilt Beauty e The North Face são finalistas; Phont, Bridge, Dateability, Language Explorer e mimiTENS receberam menção honrosa. A lista saiu em 14 de setembro.

Ler o post
IA & Tech18 set 2026Mooni viu em Raphael Batyrbaev

Raphael Batyrbaev lança o DeLibra, biblioteca de design system feita para agentes de IA lerem e escreverem

Raphael Batyrbaev, Staff Product Designer da Grafana Labs baseado na Itália, publicou o DeLibra, ferramenta de código aberto que transforma um design system em uma "libra": uma biblioteca estruturada que pessoas leem como documentação e agentes de IA usam como dado e contexto. A libra pode nascer de um arquivo do Figma, de um CSS de produção ou de um repositório, e é preenchida por um agente guiado por uma skill própria. O código está no GitHub desde agosto de 2026, sob licença Apache 2.0.

Ler o post