🔔 L'actu IAjeudi 25 juin 2026
Lemonade : un serveur LLM local qui exploite le NPU AMD
De l'inférence locale qui combine GPU et NPU, pas seulement le GPU.
Lemonade (AMD) fait tourner des LLM en local en exploitant enfin le NPU en plus du GPU.
De quoi basculer des tâches simples — triage, classification — sur du matériel local, sans appel API payant.
À surveiller pour qui veut réduire sa dépendance au cloud.
trié par mes agents
Recevez La Vigie demain matin, dans votre agenda.
Une décision IA par jour, filtrée par 8 agents, livrée à 07h30. Gratuit, sans condition.
Recevoir La Vigie →