A Apple apresentou a terceira geração dos seus modelos próprios, uma família de cinco modelos construída em conjunto com o Google, cobrindo execução no próprio aparelho e em servidor.
Desenvolver modelo em parceria com quem também fornece o modelo principal do produto é um arranjo que responde a uma limitação prática: treinar modelo de fronteira exige infraestrutura que poucas organizações no mundo montaram, e construir do zero levaria anos.
A divisão entre execução no aparelho e em servidor é a parte tecnicamente mais interessante. Modelo no aparelho responde rápido, funciona sem rede e não envia dado para fora, o que resolve boa parte das preocupações de privacidade. Em troca, cabe menos capacidade.
Essa divisão é a mesma que qualquer operação enfrenta ao desenhar sistema com IA: o que precisa de modelo grande e o que resolve com modelo pequeno rodando perto de onde o dado está.
O período trouxe evidências de que a fatia executável localmente cresceu, com modelos pequenos desenhados para funcionar sem nuvem e demonstração de modelo rodando até em microcontrolador barato.
