L'appliance de calcul IA sur site

Zharis

La puissance d'un cloud, sur votre propre infrastructure.

Une appliance matérielle rackable qui exécute localement des grands modèles de langage performants. Une puissance IA de classe cloud dans une seule unité de rack. Installée dans votre datacenter, sous votre gouvernance, sans qu'une donnée ne franchisse vos murs.

1UEncombrement en rack 10 Gb/sTrame d'E/S 0Dépendance au cloud
Zharis — 1U on-premise AI compute appliance
What it is

Un boîtier rackable qui place l'IA entre vos murs.

Zharis, c'est du matériel. Une appliance de calcul IA autonome que vous glissez dans votre rack comme n'importe quel serveur. Elle exécute les grands modèles de langage en local : votre organisation dispose d'une IA de classe cloud sans envoyer le moindre octet à un tiers.

Matériel rackable

Une unité 1U conçue pour s'intégrer dans un rack 19" standard : ici, l'appliance IA est le produit, pas un abonnement cloud.

LLM en local

Des modèles de langage performants s'exécutent sur l'appliance elle-même : assistants, RAG, analyse et automatisation, sans qu'aucun appel API ne quitte votre réseau.

Vos données restent chez vous

Chaque prompt, document et inférence reste dans votre infrastructure : souveraineté et conformité par l'architecture, pas par une clause.

Puissance de classe cloud

La densité de calcul et la bande passante d'un nœud cloud, un fabric I/O à 10 Gb/s et une accélération IA dédiée, dans un format que vous possédez et exploitez.

Conçue de bout en bout par Thelis, née du programme de recherche ReconnAIssance.

Specifications

Sous le capot.

Configurations

NVIDIA Jetson AGX Orin 32GB 32 GB LPDDR5 unifiée
NVIDIA Jetson AGX Orin 64GB 64 GB LPDDR5 unifiée
NVIDIA Jetson AGX Thor 128 GB LPDDR5 unifiée

Exécutez en local n'importe lequel des grands modèles ouverts de référence, de Gemma sur le NVIDIA Jetson AGX Orin jusqu'à GPT-OSS-120B sur le NVIDIA Jetson AGX Thor. Plus la mémoire unifiée est grande, plus le modèle que vous pouvez servir est volumineux.

Format & mécanique

Unités de rack1U
Dimensions (L×P×H)Sur demande
PoidsSur demande
MontageStandard rack 19"

Calcul

PlateformeNVIDIA Jetson AGX Orin · NVIDIA Jetson AGX Thor
GPUGPU NVIDIA intégré + Tensor Cores
CPUBasé sur Arm (SoC Jetson)
AccélérationNVIDIA TensorRT

Mémoire & stockage

Mémoire unifiée32 / 64 GB (AGX Orin) · 128 GB (AGX Thor)
Architecture mémoireUnifiée : LPDDR5 partagée CPU/GPU
StockageSur demande

Réseau & I/O

Réseau10 GbE
PortsSur demande
AdministrationSur demande

Alimentation & dissipation

AlimentationSur demande
Consommation (typ. / max)Sur demande
RefroidissementSur demande
Température de fonctionnementSur demande

IA & logiciel

Taille de modèle maximaleLimité par la mémoire et la précision, jusqu'à gpt-oss 120B (AGX Thor)
Modèles pris en chargeToutes classes : LLM, vision, audio, embeddings
Environnements d'exécution LLMTensorRT-LLM, vLLM, Ollama
FrameworksPyTorch, TensorFlow, ONNX · Docker
Système d'exploitationLinux basé sur Ubuntu (NVIDIA Jetson)
DébitDépendant du modèle et du GPU, évalué pour chaque déploiement
APISur demande

Conformité

CertificationsSur demande
Gouvernance des donnéesConforme RGPD / NIS2

Spécifications finales confirmées pour chaque déploiement. Contactez-nous pour la fiche technique complète.

What you can run

De vraies charges IA, entièrement en local.

Assistants privés

Des copilotes internes et des assistants conversationnels ancrés dans votre propre savoir : accessibles à vos équipes sans rien exposer à un modèle public.

RAG sur documents privés

Génération augmentée par récupération sur votre corpus confidentiel, contrats, dossiers, archives, interrogeable et consultable, en on-premises.

Analyse de documents et de données

Résumé, extraction, classification et structuration de vastes ensembles documentaires : la donnée brute devient un signal exploitable.

Automatisation des workflows

Intégrez l'inférence locale à vos processus, tri, routage, génération et aide à la décision, sans facture cloud récurrente au token.

Why on-premise

L'IA dont vous avez besoin, sans l'exposition.

Souveraineté des données

Conformité RGPD, NIS2 et sectorielle dès le premier jour. Aucune donnée transmise à l'extérieur : votre posture réglementaire reste nette et auditable.

Latence déterministe

Aucun aller-retour réseau, aucune contention d'infrastructure partagée. L'inférence a lieu en local, à vitesse constante, indépendante des conditions extérieures.

Contrôle total

Vous choisissez les modèles, définissez les règles d'accès et maîtrisez le calendrier de mise à jour. Aucun verrouillage fournisseur, aucune tarification surprise : le système évolue comme vous le décidez.

Deploy & integrate

Rackez. Connectez. Appelez l'API.

01

Rack

Montez l'appliance 1U dans votre rack existant et mettez-la sous tension : aucune refonte de datacenter, aucune infrastructure spécialisée requise.

02

Connexion

Raccordez-la à votre réseau privé. Tout s'exécute dans votre périmètre : l'appliance n'a jamais besoin d'un accès Internet sortant pour fonctionner.

03

Intégration

Pointez vos applications vers l'API locale et servez vos inférences. Elle s'insère dans votre stack comme n'importe quel service interne.

En option, entièrement géré

Vous le voulez déployé, audité et maintenu pour vous ?

Zharis fonctionne parfaitement seul. Si vous préférez confier à Thelis l'implémentation, les audits trimestriels et la maintenance continue, le Local AI Bundle place l'appliance au cœur d'un accompagnement géré complet.

Book a demo

Voyez Zharis faire tourner l'IA
entre vos murs.

Décrivez-nous votre infrastructure et votre cas d'usage IA. Nous organiserons une démonstration en direct de l'appliance exécutant votre charge de travail, sur site.