Vibe coding para escolher modelo pela persona e não pelo spec: Chat ficou na marca
DeepSeek Chat ficou na persona, 290 ms. O V4 Flash virou consultor e cortou a última frase. Thiago deixou o Chat no simulador de tom de voz.
No simulador de tom de voz da marca, Thiago comparou DeepSeek Chat e DeepSeek V4 Flash e pediu para ser 100% criterioso sob ótica de engenharia de prompt. O Chat ficou na persona, 290 ms, com o texto pronto para o usuário copiar e colar. O Flash agiu como consultor e, ao bater no teto de tokens, cortou a última frase.
COMPARAÇÃO
DeepSeek V4 Flash
Agia como consultor e, no teto de tokens, cortou a última frase
DeepSeek Chat
Ficou na persona, 290 ms, pronto para copiar e colar
Isso é vibe coding para escolher modelo pela persona e não pelo spec. O agente descreveu o Flash como variante otimizada para altíssima velocidade, eficiência, custos e desempenho em código, e o Chat como versão padrão de conversação, uso geral. Thiago constrói o Taurus, produto de audiência com IA, receita ainda R$0. Quem abre o simulador precisa de um parágrafo na voz da marca para colar no lugar em que a marca fala.
Ele não conhecia o Chat e pediu o critério a 100%
A 1ª chamada do simulador tinha usado Chat, não o Flash. Thiago leu o nome na tela e não reconheceu:
Mas por que que usou deep sick chat? Ah, de psichat. Nem conheço isso. Qual a diferença do de para?
A transcrição escreve "deep sick chat" e "de psichat"; na tela era DeepSeek Chat. A pergunta era a diferença entre os 2, depois de o simulador já ter rodado no Chat. Thiago ouviu essa diferença e ainda quis o julgamento das 2 respostas.
A pergunta curta veio primeiro: na sua opinião, seja criterioso, qual das 2 respostas foi melhor, com DeepSeek Chat ou com DeepSeek V4 Flash. Depois ele subiu a régua:
Uma pergunta na sua opinião seja criterioso, tá? 100% criterioso e analisando sobre a ótica copyright o X engenharia de prompt
Fora das aspas, "copyright o X" é ótica de copy e engenharia de prompt. O critério era o parágrafo que o usuário do Taurus ia colar, com a persona intacta.
O Chat falou como a marca; o Flash cortou a última frase
O agente relatou a comparação na tela, e Thiago ouviu e aceitou.
No Chat, o agente apontou incorporação perfeita da persona e zero meta linguagem, sem a frase "Eu sugiro que você responda". O texto saiu na voz da marca, pronto para copiar e colar, e a latência deu 290 ms.
No Flash, o raciocínio estratégico apareceu no exemplo de não usar termos defensivos na garantia de 30 dias. A prolixidade e a metacomunicação pesaram: o modelo agiu como consultor em vez de entregar o texto pronto para envio e, ao bater no teto de tokens, cortou a última frase. A latência veio mais lenta.
O usuário do Taurus cola o que o simulador devolve. Um consultor no meio da resposta obriga a editar, e uma frase cortada no teto de tokens deixa o envio pela metade.
No vibe coding, o modelo oficial é o que ficou na persona
Thiago confirmou o modelo ativo:
Sim, quero. chat foi melhor mesmo.
O "Sim, quero" responde ao agente, que perguntou se podia deixar o Chat como modelo ativo oficial do simulador. Na transcrição isso aparece como "modelativo". O simulador de tom de voz ficou com o Chat no lugar de modelo oficial.
O custo entrou na sequência:
Pô, pouquinho mais caro. Beleza.
O recorte em que o nome do modelo some do payload do cliente está em o que é white label. Aqui o teste é qual modelo fala como a marca.
No vibe coding deste simulador, o modelo entra no produto pelo parágrafo que o usuário cola, depois de um teste pedido a 100% de critério.
Mande o mesmo brief nos 2 antes de cravar o spec
Se o seu fluxo escreve na voz de uma marca, mande o mesmo brief nos 2 candidatos. Leia se o texto fala como a marca (se aparecer "Eu sugiro que você responda", saiu da persona) e se a última frase chegou inteira. Neste simulador o Chat ficou na persona, 290 ms, e Thiago deixou esse modelo como oficial.
ANTES DE CRAVAR O SPEC
- 01Mande o mesmo brief nos 2 candidatos
- 02Leia se o texto fala como a marca; se aparecer Eu sugiro que você responda, saiu da persona
- 03Leia se a última frase chegou inteira
Amanhã, no fluxo que escreve como uma marca, rode esse teste antes de cravar o modelo pelo spec de velocidade e custo. A tela das 2 respostas está na gravação. Vale assistir à live para ouvir o "chat foi melhor mesmo" depois do critério a 100%.