Converse com DeepSeek-V4-Pro

AI ChatDeepSeek-V4-Pro

O que é DeepSeek-V4-Pro hoje?

DeepSeek-V4-Pro é o modelo da DeepSeek para raciocínio e agentes. O anúncio de 13 de agosto confirma a disponibilidade geral no App, na Web e na API; a página inicial atual confirma essa oferta. Na consulta de 8 de setembro de 2026, o nome de API `deepseek-v4-pro` corresponde a DeepSeek-V4-Pro-0813. Esta página trata dessa versão, sem misturar o Preview de abril, a atualização do Flash de julho ou o modelo experimental Vision separado. Vale testar o Pro quando uma decisão intermediária errada pode comprometer várias etapas seguintes. Forneça evidências, restrições e uma maneira de refutar a proposta. Os cenários abaixo são sugestões de trabalho, não garantias de sucesso comprovadas em testes.

Limites da API e controles úteis

  • Textos longos e trabalho estruturado: A tabela atual da API informa contexto de 1M de tokens e saída máxima de 384K para o Pro, além de saída JSON, chamadas de ferramentas, Responses API e Anthropic API. Uma janela maior comporta mais evidências, mas não garante recuperação precisa nem execução correta de ferramentas.
  • Inclua saídas e novas tentativas no orçamento: No horário de pico, o Pro cobra, por milhão de tokens, US$ 0,044 de entrada em cache, US$ 1,32 sem cache e US$ 3,96 de saída. Fora do pico, os valores caem pela metade. O pico ocorre de segunda a sexta, das 01:00 às 04:00 e das 06:00 às 10:00 UTC. São preços da API DeepSeek sujeitos a mudanças, não do Ottermind. Inclua tentativas malsucedidas e saídas repetidas no custo da tarefa.
  • Escolha o esforço de raciocínio: O guia de pensamento documenta low, high e max; o pensamento vem ativado em high. Medium e xhigh correspondem a high. Nesse modo, temperature e top-p não têm efeito; integrações com ferramentas devem devolver o reasoning_content anterior. Comece com high e compare max no mesmo caso que falhou, sem presumir que pensar por mais tempo é melhor.

Quatro tarefas complexas para continuar no Ottermind

Traga evidências em texto e critérios claros de aceitação. Cada tarefa produz algo verificável antes da próxima decisão.

  • Planeje uma migração de banco com caminho de volta

    Forneça os schemas antigo e novo, invariantes e restrições de implantação. Peça uma migração ordenada, consultas de validação e o limite para rollback. Ensaie em uma cópia descartável e confira contagens de linhas e restrições. Leve a primeira consulta que falhou ao Studio e revise apenas a fase afetada antes de avançar.

  • Separe as possíveis causas de um incidente

    Forneça logs sanitizados, uma linha do tempo e duas causas plausíveis. Peça uma tabela de hipóteses com evidências, contradições e um teste que diferencie cada causa. Confira os horários e execute um teste seguro. Leve o resultado real ao Studio e pergunte qual hipótese descartar e o que medir em seguida.

  • Questione o algoritmo antes de implementá-lo

    Forneça o problema, os limites de entrada, o algoritmo candidato e exemplos. Peça as premissas, uma justificativa da complexidade e casos adversariais. Compare entradas pequenas com uma referência por força bruta e examine os contraexemplos. Retorne esse exemplo ao Studio e peça o algoritmo corrigido com o teste que revelou o erro.

  • Desenhe um experimento com critério de parada

    Forneça a pergunta de pesquisa, resultados de referência, recursos computacionais e a métrica de sucesso. Peça um plano controlado com variáveis fixas, ablações e critério de parada. Recalcule a referência e verifique vazamento de dados. Leve as medições ao Studio e revise o próximo experimento sem apresentar uma hipótese não testada como descoberta.

Quando vale pagar mais pelo Pro que pelo Flash?

Critério de decisãoDeepSeek-V4-ProDeepSeek-V4-Flash
Versão atual da APIDeepSeek-V4-Pro-0813DeepSeek-V4-Flash-0731
Entrada no pico: com / sem cacheUS$ 0,044 / US$ 1,32 por 1M de tokensUS$ 0,014 / US$ 0,44 por 1M de tokens
Saída no picoUS$ 3,96 por 1M de tokensUS$ 1,32 por 1M de tokens
Escolha com seu próprio caso difícilVale testar se decisões melhores puderem evitar várias etapas fracassadas; meça resultados aceitos em relação ao custo totalUma referência mais barata para tarefas delimitadas; mantenha se o Pro não melhorar a qualidade útil nas mesmas verificações

Avalie o ciclo completo de raciocínio

Onde vale testar o Pro

  • Decisões que afetam o trabalho seguinte: A ordem de uma migração e a seleção de hipóteses exigem mais que um texto convincente. Peça ao Pro que explicite premissas e condições de falha, para testar a decisão antes de investir nas etapas dependentes.
  • Evidências ao longo de várias etapas: Mantenha identificadores de fontes e resultados intermediários aceitos na conversa. Peça a cada etapa proposta que cite suas evidências e indique o que ainda é desconhecido. Isso facilita auditar e retomar uma tarefa longa.

O que ainda depende do seu julgamento

  • Um plano convincente também pode estar errado: Os testes gerados podem repetir a mesma premissa equivocada da solução. Use uma referência independente, uma invariante conhecida ou um caso reservado. Interrompa uma abordagem que repete a mesma falha, em vez de pagar por outra reformulação.
  • Preço por token não é tempo até concluir: No mesmo período tarifário, a entrada sem cache e a saída do Pro custam três vezes as do Flash. Só seus resultados medidos podem justificar esse adicional. Conte novas tentativas, espera e revisão; estas fontes não comprovam uma vantagem universal de velocidade.

O que usuários do Pro realmente testaram

São relatos individuais da fase de disponibilidade geral, não consenso nem comparações controladas entre provedores atuais. Servem para planejar um teste, não para prever seu resultado.

A iteração pode melhorar sem resolver tudo

O relato de Brotherindeed de 16 de agosto descreve um trabalho útil de hipótese, teste e validação com o 0813 via OpenCode Go e Pi, sem hospedar pesos localmente. Em uma avaliação separada de 16 desafios Hack The Box, TheArtificalQ relatou resultados de resolução próximos aos do 0423, mas a mediana de etapas caiu de 62,5 para 12,5; os casos difíceis continuaram falhando. Esse teste restrito de agentes não prova superioridade geral em código nem velocidade da API.

O uso de cache muda a avaliação de custo

Em uma discussão de 13 de agosto sobre custos de programação, um usuário do Pro-0813 relatou alto consumo de tokens, enquanto respostas destacaram a porcentagem de acertos de cache. O tópico antecede a mudança de preços de 16 de agosto; as contas pessoais não são estimativas atuais. Registre separadamente entrada em cache, entrada nova, saída e novas tentativas ao comparar suas cargas.

Da pergunta difícil à decisão verificada

1

Defina o que refutaria a resposta

Cole o texto relevante e indique a invariante, o resultado de referência ou a medição que determina a correção. Peça uma proposta delimitada e as premissas pendentes antes de solicitar toda a implementação.

2

Leve o prompt ao Studio

Continue no Ottermind Studio e entre na conta se necessário. Selecione DeepSeek-V4-Pro somente se sua conta oferecer essa opção. A transferência leva texto; não envia arquivos, escolhe um modelo automaticamente nem confirma acesso à API.

3

Revise a partir de evidências observadas

Execute a verificação fora da conversa, cole a divergência exata e peça uma revisão focada. Preserve o trabalho validado e defina um limite de tentativas antes de aumentar o esforço ou testar outro modelo.

Dúvidas sobre DeepSeek-V4-Pro

DeepSeek-V4-Pro ainda é Preview?

Não. A DeepSeek anunciou a disponibilidade geral do Pro no App, na Web e na API em 13 de agosto de 2026. Na consulta de 8 de setembro, a tabela identifica DeepSeek-V4-Pro-0813 sob `deepseek-v4-pro`. Avaliações antigas do Preview não descrevem automaticamente esta versão.

A versão Pro inclui Vision?

Não deduza suporte visual a partir do lançamento separado de `deepseek-v4-flash-vision-exp`. Esta página prepara tarefas de texto e não afirma que o Pro aceite imagens. As opções de arquivos e modelos no Studio dependem do que sua conta realmente oferece.

Como comparar os custos do Pro e do Flash?

No mesmo período tarifário, entrada sem cache e saída do Pro custam três vezes as do Flash; a proporção da entrada em cache é um pouco diferente. Compare a conta total por resultado aceito, incluindo falhas. Fora do pico, os preços são metade dos de pico; são tarifas da API DeepSeek, não do Ottermind.

Toda tarefa complexa deve usar max?

Comece com high e uma verificação reproduzível. Teste max quando um caso difícil falhar e compare correção, tokens de saída e tempo decorrido. Pensar mais não prova que a resposta está correta, e produtos de chat podem oferecer controles diferentes dos documentados na API.

Torne a próxima decisão verificável

Leve evidências, restrições e uma verificação para o Ottermind Studio.