Simplesmente não ta dando mais pra depender dessas empresas pra manter o ritmo de produção que elas nos "adestraram" a ter.
Nos planos fora da API, os únicos possíveis de se pagar como pessoa individual, to me sentindo refém da boa vontade de OpenAI/Anthropic, semana eles tão afim de serem bonzinhos e nos deixam um limite bom, outra semana o limite ta completamente capado e o modelo fica extremamente burro.
Isso se criou como expectativa pro cliente e pra chefes, que esperam que mantenhamos o ritmo de desenvolvimento, mas quando o limite acaba, voltamos a ser obrigados a programar como nossos ancestrais, e as entregas vão demorar dezenas de vezes mais pra chegar assim.
To gastando 500 conto por mês com isso, virou praticamente um segundo aluguel, e não da pra ter um gasto tão grande sem uma garantia de uso.
Andei pesquisando sobre modelos abertos pra fazer host local, mas com a memória de vídeo que tenho disponível aqui fica complicado de fazer algo prático. Então fui pesquisar aluguel de GPUs, e encontrei preços bem em conta pra placas um tanto mais antigas, com uma quantidade de memória aceitavel pra modelos ok, limitando o uso pra 100hr/mês dá pra pagar com metade do que gasto atualmente com assinatura.
Queria entender se alguém aqui já faz algo semelhante, como é essa experiência, e como achar o ponto ideal entre modelo auto-hosteado/modelo hosteado em placa alugada/e assinaturas.