
O Ollama disponibilizou uma nova atualização de sistema, a versão 0.30, focada em trazer otimizações de velocidade e um suporte mais abrangente para diversos componentes informáticos. Conforme foi detalhado no blogue oficial da Ollama, a grande novidade desta iteração é a capacidade de extrair um rendimento até 20% superior em cenários de computação que utilizem placas gráficas da NVIDIA.
Aceleração gráfica por predefinição
Para lá das melhorias diretas nos chips gráficos mais populares do mercado, o Ollama 0.30 passa a ativar a aceleração por GPU através da API Vulkan de forma nativa e automática. Esta alteração técnica permite alargar o ecossistema de inteligência artificial a utilizadores com componentes da AMD e da Intel.
Graças a esta unificação de tecnologias, deixa de ser obrigatório instalar ou configurar bibliotecas proprietárias ou específicas de cada fabricante para conseguir acelerar a execução local de grandes modelos de linguagem no teu próprio hardware.
Maior compatibilidade com modelos GGUF
A equipa de desenvolvimento aproveitou ainda esta ronda de atualizações para expandir as fundações do projeto através do ecossistema llama.cpp. Na prática, isto significa que o suporte para ficheiros e modelos no formato GGUF foi substancialmente melhorado.
Os utilizadores passam assim a ter acesso imediato a uma biblioteca muito mais vasta de projetos e variantes de inteligência artificial, que passam a funcionar sem necessidade de conversões complexas ou configurações adicionais assim que a aplicação é instalada no ecrã do computador.












Nenhum comentário
Seja o primeiro!