Whisper OpenAI no vibe coding: não rode local no Mac
Zampa travou o Overclock Voice no Whisper local. Danilix mandou o STT para o Grok: no Mac a memória fica cheia, o cache cresce e o vibe coding fica lento.
Zampa entrou na live do Danilix com o Overclock Voice travado, depois de já ter falado com ele no Discord. O STT estava no Mac: o Whisper OpenAI corria local, comia processamento, deixava a memória cheia e ia gravando cache até o sistema ficar lento na hora de codar. Danilix mandou colocar o Grok. A transcrição saiu da máquina e o Overclock Voice andou.
Rodar Whisper OpenAI no Mac enche o cache e deixa o vibe coding lento. A troca que destravou o Zampa foi mandar o STT para a nuvem. Vale ver como isso terminou em codex openai.
COMPARAÇÃO
Whisper local no Mac
Enche o cache e deixa o vibe coding lento
STT na nuvem com Grok
A transcrição sai da máquina e o Overclock Voice anda
Zampa chegou, tomou um couro e o Whisper saiu do Mac
Ele chegou, conseguiu, tomou um couro. A conversa do Discord já apontava o Grok, e mesmo assim o produto de voz ainda estava preso quando ele entrou na live. O Overclock Voice falhava com o Whisper sentado no mesmo Mac que deveria escrever o código. Danilix repetiu em voz alta o recado que já tinha saído no Discord:
Mas eu disse-te porque estavas a usar whisper, colocaste o groquzinho. O Grockzinho, mano, ele resolve, ok, pai?
Zampa colocou o Grok. O processo pesado saiu do Mac e a transcrição passou a ser um pedido na nuvem. O modelo de transcrição era o Whisper OpenAI. A nuvem, nesta sessão, foi o Grok. O couro foi ouvir de novo, na live, o que o Discord já tinha dito: Whisper ainda no Mac. Ele ouviu a mesma frase 2 vezes para o STT sair do hardware. Saiu o modelo da máquina e o Overclock Voice voltou a responder. Foi o mesmo caminho de onboarding de cliente.
Whisper local no Mac come o vibe coding
Danilix apontou o custo na máquina. Enquanto o Whisper transcreve no Mac, o editor e o agente dividem memória e processamento com um STT que podia estar fora. O código espera enquanto o cache cresce. A sessão de vibe coding fica pesada sem o repositório ter mudado.
Mas, mano, vais consumir muito do teu processamento. Não vale a pena, não, tá ligado?
No Mac esse consumo pega a memória de um jeito que o Windows não pega. Danilix tinha lido uma parada sobre isso: a máquina trabalha com a memória cheia e vai salvando muita coisa no cache, até o sistema ficar lento. O editor e o agente passam a disputar espaço com o que o Whisper já deixou gravado. A máquina que está a escrever o produto também guarda o áudio no cache.
Ainda mais que o Mac, estava a ler uma parada sobre ele, ele ele não trabalha igual o Windows com a memória reduzida. Ele trabalha com a memória cheia, tá ligado? E depois nisso ele vai salvando muita coisa no cachet dela, tá ligado? E depois acaba que pode deixar com lentidão o teu sistema, tá ligado?
Essa lentidão pega o sistema inteiro no meio da sessão, quando você pede resposta ao agente e o editor precisa de memória livre. Quando o Overclock Voice precisa de transcrição, o Whisper local roda no próprio Mac, e o Mac, já com a memória cheia, empurra mais estado para o cache. Com o editor e o agente abertos, o atraso aparece entre o pedido e a resposta. Se o STT é um processo no mesmo Mac do editor, você paga a transcrição com a velocidade do código.
E rodar local não vale a pena, tá ligado?
Quando a conta da nuvem bate o limite
Você traz o Whisper OpenAI para o Mac quando a conta da nuvem estoura e o Grok para. A sessão de voz some e instalar o modelo em casa parece a saída que não depende de cota. Danilix ofereceu outra conta. Foi o mesmo caminho de comparar produto.
Quando bater o limite troca, entendeu? Depois vai trocando, pode ir trocando quando bater o limite.
Criar outra conta e trocar quando bater o limite sai mais barato do que deixar o Mac a salvar cache até o editor ficar pesado. O caminho de volta do Zampa para um Overclock Voice a funcionar foi o Grok. Se o Grok bater o limite, outra conta. Trocar de conta quando a cota cai mantém o STT fora do Mac e a transcrição na nuvem. O processador fica com o código. Isso aparece também em funil de vendas o que é.
Antes do próximo bloco com microfone ligado, confere onde o STT está a correr. Se for Whisper OpenAI no próprio Mac, tira e manda a transcrição para a nuvem. Se a conta bater o limite, troca de conta.
Foi numa Caverna Coding de 631 min. Dá para assistir à live no ponto em que o Zampa entra, toma o couro e o Overclock Voice volta a andar.