2023-10-12 10:51:53

De acordo com um relatório da Webmaster House em 12 de outubro, a equipe de IA / ML da Apple e a equipe de pesquisa da Universidade de Columbia desenvolveram um modelo multimodal grande "Ferret" que pode encontrar com precisão semáforos em imagens, que funciona melhor do que o GPT-4V e melhora a precisão de modelos grandes em tarefas de "olhar, falar, responder". A principal inovação de Ferret reside na estreita combinação de compreensão espacial de referência e fundamentação, permitindo que o modelo compreenda a semântica de uma determinada região e encontre o alvo correspondente ao mesmo tempo.

Ver original

Esta página pode conter conteúdo de terceiros, que é fornecido apenas para fins informativos (não para representações/garantias) e não deve ser considerada como um endosso de suas opiniões pela Gate nem como aconselhamento financeiro ou profissional. Consulte a Isenção de responsabilidade para obter detalhes.

1 Curtidas

Recompensa
1
Comentário
Repostar
Compartilhar

Comentário

0/400

Sem comentários

Tema
#July PPI Beats Expectations
39k Popularidade
#ETH ETFs Top $30B
41k Popularidade
#Gate Alpha Peak Trading Competition
150k Popularidade
#Gate Releases August Reserves Report
19k Popularidade
#BTC Hits New ATH
107k Popularidade

Marcar

sitemap