Aller au contenu

Entreprises et modèles

Google / Gemini Dernières actualités

Google et DeepMind : l'actualité de l'IA — suivi continu de la série Gemini, du modèle vidéo Veo, des résultats de recherche et de l'écosystème produit.

131 sélections30 derniers jours 11 entréesTotal : 219 entrées

mise à jour

Archives de la sélection · page 7

5 novembremer.121–131 entrées
  1. Google Research62

    Google Research présente Project Suncatcher : exploration d'une conception de système d'infrastructure IA scalable basée dans l'espace

    Google Research a publié le preprint « Towards a future space-based, highly scalable AI infrastructure system design » et dévoile Project Suncatcher.

    Motif de la recommandation :L'article expose le design système, les quatre défis techniques et les données de test des TPU, permettant de comprendre les contraintes réelles du calcul IA dans l'espace.

30 octobrejeu.
28 octobremar.
  1. Google Research60

    Google déploie un aperçu public de son coach santé personnel propulsé par Gemini

    Google Research annonce le déploiement d'un aperçu public optionnel du coach santé personnel pour les utilisateurs Fitbit Premium Android aux États-Unis.

    Motif de la recommandation :L'article détaille l'architecture multi-agents et le cadre d'évaluation SHARP derrière le coach santé Gemini, utile pour comprendre comment un assistant grand public est construit et validé.

26 juinjeu.
12 marsmer.
5 décembrejeu.
31 juilletmer.
27 juinjeu.
14 maimar.
  1. Hugging Face Blog73

    Google publie PaliGemma, une famille de modèles vision-langage open source

    Google publie PaliGemma, une famille de modèles vision-langage open source composée d'un encodeur d'images SigLIP-So400m et d'un décodeur de texte Gemma-2B. Trois types de checkpoints sont disponibles (pré-entraînés, mix et fine-tunés), en résolutions 224x224, 448x448 et 896x896 et en précisions bfloat16, float16 et float32, avec intégration à transformers et à l'implémentation JAX d'origine. Les modèles mix atteignent 46,00 de précision MMVP et 88,00 de précision POPE en 224, tandis que les modèles fine-tunés couvrent des tâches comme VQAv2, COCO Captions, ScienceQA et refcoco.

    Motif de la recommandation :Présentation des trois variantes de PaliGemma, de leur architecture SigLIP+Gemma et des scores de benchmarks transférés, utile pour évaluer les modèles vision-langage open source.

9 avrilmar.
21 févriermer.