App Bluewillow, imagens AI, porque não há duas sem três!

 

(2048x2048 px, a imagem depois de escalada - Upscale 2)

Depois de testar a SeaArt.AI - mais uma vez vos convido a juntarem-se a mim, clicando neste link - e a app. Leonardo.Ai, resolvi tentar a sorte com a Bluewillow, pois li que as imagens geradas tinham bastante qualidade. Esta app funciona tal e qual o Midjourney, - embora use o Stable Difusion e outros modelos - dentro do Discord. 

O BlueWillow permite apenas 10 prompts diárias com o modelo V2 e V3, limite de 5 pedidos em simultâneo, e anúncios publicitários, embora se possam fazer variações, escalamentos, outpaints,  e novos pedidos da mesma prompt a partir daí sem limites. O comando  /info permite saber a quantas andamos. Não é muito, dá para treinar e conseguir obter algumas imagens, ponderar se vale a pena subscrever, etc. 

No patamar seguinte os usuários pagam 5 dólares por 50 prompts e mais alguns benefícios, acesso a modelos posteriores, etc. E por aí fora. Não é muito simpático e dos poucos testes que fiz não gostei muito da qualidade das imagens no plano gratuito. É possível que os modelos posteriores façam a sua diferença, mas gostava que mesmo no patamar grátis pudessemos experimentar o que o BlueWillow faz de melhor, não isto, uma proposta que me parece não incentivar ninguém a pagar. 

O BlueWillow actualmente gera imagens usando V3 como modelo padrão. Como assinante, pode mudar para o modelo V4 de alta resolução adicionando o parâmetro “--V4” no final do seu prompt. O modelo V4 oferece recursos superiores de geração de imagem, incluindo uma melhoria de 2X na qualidade de upscaling. 

Os anúncios aparecem no stream enquanto aguardamos a geração! 
Ainda não tinha encontrado um Modelo com anúncios.

Os geradores de imagem AI são tecnologia incrivelmente cara e a Microsoft e Google, como gigantes empresariais, são os únicos que podem oferecer borlas. Mas estas "borlas" não são um acto generoso, talvez eles encontrem um forma sub-reptícia de monetizar o nosso uso, ou até talvez vendam os nossos dados. Não há almoços grátis, nunca se esqueçam disso, "poderão oferecer esses serviços "de graça" como um líder mas garanto que descobrirão uma maneira de monetizar vendendo seus dados ou informações pessoais", pode ler-se no Discord do Bluewillow.

Já agora, que falei dos dois gigantes empresariais do nosso tempo, não deixa de ser preocupante que essas duas empresas tenham incorporado a AI ( a Microsoft incluiu-o no Bing, em Fevereiro, e um mês depois a Google lançou o chatbot Bardo) sem atender aos próprios críticos internos que acharam cedo e perigoso introduzir um chatbot que podia concorrer para criar mais desinformação, abuso, possibilitar violações de privacidade, etc, sem antes estar acautelada a segurança. Além da corrida pessoal ao lucro com a exploração destas AI há também uma corrida por parte das empresas que querem dominar o mercado com esta inovação. O pontapé de saída foi em Novembro, quando a OpenAI, uma start-up de São Francisco que trabalha com a Microsoft, lançou o ChatGPT, um chatbot que conquistou o mundo inteiro com as suas possibilidades. Como podem ver, a AI motivou uma autêntica febre, não apenas no domínio da geração de imagens, de tal forma que até o delirante e visionário Elon Musk, e também o cofundador da Apple, Steve Wozniak, pediram uma pausa de seis meses no desenvolvimento da tecnologia de IA , escrevendo uma carta pública, onde afirmavam que a AI apresentava “profundos riscos para a sociedade e a humanidade”. A segurança nunca devia ser posta em causa mas estas empresas podem ter dado o passo maior que as pernas ao não acautelar o risco de uma tecnologia pioneira. Veremos o que acontece.

Print do Discord

Mas, de regresso ao BlueWillow, como fiz para usar? Criei um servidor no Discord, adicionei o Bluewillow  a partir do directório de apps e pronto. Chamei-lhe "Blue". Assim posso criar as minhas imagens no meu cantinho, de forma privada. Digitei a minha primeira prompt tal e qual como fazia no Midjouney, o ano passado, usando o comando /imagine, e dando um espaço, na caixa de conversação, e gerei quatro imagens quadradas, que é o formato padrão. 

Perante a pergunta se utilizar o BlueWillow para gerar imagens significa  roubar arte de outros artistas,  Bluewillow diz nas FAQ que não, que "usam modelos disponíveis publicamente e respeitam os direitos de outros artistas. Acreditam que o BlueWillow é uma ferramenta que artistas profissionais e amadores podem usar para criar todos os tipos de arte e imagens incríveis."

Também diz na sua página que a "geradora de imagens foi projetada para ser amigável e acessível a todos. Não importa o nível de experiência ou especialização, pode facilmente criar imagens incríveis com nossa ferramenta. Basta inserir seu prompt e deixar nossa IA fazer o resto - é tão fácil quanto isso!", Sim, é verdade, não são  falsas promessas. É só preciso dominar a escrita de prompts! Nos últimos dias, sempre que tenho um pedaço de tempo livre, tenho testado prompts. Apesar de algum treino, nem sempre chego depressa ao resultado. É fácil chegar a "um resultado" satisfatório, mas alcançar "o resultado" que se antecipava é o meu objectivo e nem sempre lá chego sem uma série de tentativas.

Uma prompt pode ser uma palavras ou até um emoji, mas prompts detalhadas dão melhor resultado.
Os prompts detalhados podem incluir URLs de uma imagem , várias frases de texto, informações adicionais e um ou mais parâmetros . 

Como usar o recurso Img2Img?

Basta colocar o link da imagem dentro do seu prompt. Image-to-image ou Img2img é uma técnica em que uma IA cria uma nova imagem usando uma imagem existente e um prompt de texto. A nova imagem terá cores e layout semelhantes aos da imagem original, mas a imagem original não precisa ter uma boa aparência ou ter detalhes específicos. A imagem original é apenas um guia para a IA criar a nova imagem.

Se tiver uma foto arquivada que deseje subir como referência a partir do seu computador pode clicar no símbolo + (mais) - abre-se um Menu que mostra Enviar um arquivo -  que se encontra na caixa onde escreve a prompt. Depois, depois clica em cima dela e no botão direito do rato, e vai selecionar Copiar endereço da imagem,  no Menu. O endereço fica em memória. Clique  fora da imagem para sair. 

Escreva de seguida /imagine na caixa de conversação e de seguida clique ali com o rato, e no botão direito vai selecionar Colar imagem, para, assim colar o endereço da imagem que ficou em memória naquele espaço da prompt. De seguida inserimos comandos para modificar essa fotografia a nosso gosto.

Também se podem selecionar duas fotos e fazer uma mistura das duas. Mesmo só subindo a foto o Bluewillow já vai gerar transformações. Se quiser subir duas tem de repetir o processo, deixando um espaço entre os dois endereços colados.

Quando utilizar um link para uma imagem certifique-se de que ela é um jpg, um png, ou um webp

(Prints da documentação da BlueWillow)

Alguns comandos correntes que devemos saber:

Como usar? No final, colocar vírgula,  dar espaço e inserir o comando.

- Negativar, isto é, excluir algo:

Comando Negativo: --no

/imagine a painting of a cute dog --no 3d, cartoon

(Os dois traços e no 3d significam que não quero imagens em 3d)

(Quando uma imagem é gerada com algo que não desejamos, podemos usar o comando negativo para retirar)

- Proporções ou ratio, isto é relação entre duas grandezas:

Comando Horizontal: --ar 3:2

/imagine watercolor of a cat --no 3d, photography --ar 3:2

Comando vertical: --ar 2:3

/imagine watercolor of a cat --no 3d, photography --ar 2:3

É importante? Sim, em especial na fotografia e no vídeo, tem importância na composição da imagem que se deseja. Aqui, por exemplo, ajustar as proporções pode evitar cabeças cortadas. Uma proporção 2:3 é boa para corpo inteiro, 3: 3 dá para aparecer mais coisas na horizontal, etc.  1:1 é o formato quadrado, ideal, por ex., para uma foto de perfil de Facebook. 16:9 é usado principalmente para fotos panorâmicas, TV, filmes, mas aqui não funciona.


- Comandos para gerar imagens em diferentes modelos ( cada um pode ser mais apropriado ao nosso objectivo, mesmo se mais antigo, ou seja, o mais recente pode não ser o melhor), atenção que há um espaço entre v e o número. Há certa informação que não foi treinada num modelo e que pode estar no seguinte, por exemplo. Então se pedirmos imagens com certas características, elas podem sair mais perfeitas no modelo selecionado. Se os resultados não saem bem numa versão, tentamos outra versão, copiando a mesma prompt e colando.

Modelo 1 V1:--v 1

/imagine a pintura aquarela de um gato --v 1

Modelo 2 V2:--v 2

/imagine a pintura aquarela de um gato --v 2

Modelo 3 V3
:- nenhum parâmetro, activado por padrão

/imagine pintura em aquarela de um gato

Modelo 4 V4:--v 4 (somente para assinantes)



Aqui estão as quatro imagens geradas, na língua inglesa - se não domina o inglês, use o Google Translate ou o ChatGpt para fazer a tradução - com a prompt: A realistic digital painting showcasing a majestic mountain landscape,a clear blue sky, and a serene lake reflecting the scenery, –ar 3:2

O que fazer com as quatro imagens geradas?

Podemos melhorar a qualidade das imagens ou obter variações a partir de cada uma das imagens geradas:

U1- A função dos "botões U" é melhorar a qualidade visual de uma imagem criando uma versão maior e mais detalhada da imagem selecionada.


V1- A função dos "botões V" é produzir versões alternativas de uma imagem que selecionamos das quatro apresentadas. O resultado é uma nova imagem que retém a estética e a composição geral do original, com modificações subtis.

A função do "botão 🔄" relança - reinicia uma geração gerando quatro imagens com base no prompt original.

Se não gostar de nenhuma imagem gerada, pode excluí-la com o X - botão de exclusão.

Após o upscale, como salvar uma imagem? Primeiro abra-a em tamanho real, depois clique com o botão direito do rato e selecione "Salvar imagem como", guarde numa pasta no seu computador.

A função Outpainting, o que faz?  

Quando uma imagem é ampliada pela primeira vez, quatro botões azuis  com seta em várias direcções aparecerão. Cada botão representa uma tarefa de pintura numa direção específica, quatro variações/orientações de pintura. O usuário pode selecionar qualquer uma das quatro imagens para pintar, ou seja, obter uma extensão da imagem em certa direcção. Se uma imagem com pintura externa for redimensionada novamente, nenhum botão de pintura externa estará disponível.


Gosto de vos mostrar os insucessos das ferramentas além dos bons resultados. 
Neste caso não podia ter corrido pior já que nenhumas das quatro "extensões" se pode aproveitar!


(Pena que nesta "ampliação" já não possa enviar uma mensagem ao BlueWillow, 
clicando no primeiro ícon. Isso ajuda-os a perceber o que têm de melhorar.)

Por mera brincadeira podemos escolher alguns emoji - escolhi o vermelho de raiva, um dino e uma árvore - e obter um retorno aleatório de quatro imagens. Apenas coloquei os emoji sem escrever prompt nem sequer escolher um ratio.


A imagem do topo direito, a número 2, é a imagem escalada a que me referi no início desta postagem. 
Apenas uma imagem sofrível, na minha opinião.


Eis o Discord do BlueWillow, cujo ambiente me recorda as minhas primeiras experiências AI no Midjouney. Foi para fugir desta azáfama que criei um cantinho só meu. 


Apesar de ter criado o Blue, há vantagem em estar no Discord do BlueWillow. Na lateral descobri a Web-gallery. Não sei se poderia ter acesso à galeria/arquivo das minhas imagens e também à galeria geral de todos os usuários se não fosse isso. Usamos a identificação do Discord para entrar aqui. Podemos alternar entre uma e outro, e até parece que vai ser possível gerar imagens por aqui...

No Discord do BlueWillow, geramos as imagens nas salas dos Rookies, que se encontram do lado esquerdo. Encontrar as imagens  no fluxo de actividade, quando as geramos pode ser complicado. Então digitamos “mentions: your username” na caixa de pesquisa no canto superior direito. As imagens aparecerão logo abaixo. Clique em “jump” ou “BlueWillow” para ver a imagem no stream.

A terminar um exemplo de prompt e o seu resultado. Creio que com esta Prompt conseguiria muito melhor noutros Modelos e é por isso que não creio que este plano grátis seja atractivo. Mas outros poderão obter outros resultados com o BlueWillow e ter outra opinião. O melhor a fazer no que toca a imagens geradas com AI é sempre, sempre, testar as plataformas e não ir atrás de opiniões.

Prompt:A city of the future, near the sea, the skyline illuminated by blue and pink neon lights , glass windows, Milkyway sky, digital painting, trending on artsation, HD, --ar 3:2,



Comentários