Qwen2
Definition
Qwen2 markerer den anden betydningsfulde generation af Qwen-modelfamilien, der …
Terms tagged with Performance
Qwen2 markerer den anden betydningsfulde generation af Qwen-modelfamilien, der …
Mixed Precision Training (MPT) kombinerer halvpræcision (FP16) og fuld præcision (FP32) …
Kimi K25 er en avanceret iteration inden for Kimi-familien af modeller produceret af …
Komprimerede tensorer er multidimensionelle array’er, der bruges i dyb læring, hvor …
Inden for AI-ingeniørkunst optimerer caching ydeevnen ved at holde nylige eller hyppige …
Asynkron behandling gør det muligt for software at udføre langvarige opgaver, såsom …
Dette felt fokuserer på at fremskynde fundamentale lineære algebra-beregninger, som er …
Kvantisering konverterer højpræcisions flydende-tal (f.eks. FP32) til …
Latens måler responsiviteten af en AI-tjeneste, typisk udtrykt i millisekunder. Det …
Distribueret træning fremskynder modellens konvergens ved at parallelisere beregningen …
Inden for kunstig intelligens betegner realtid evnen hos et system til at behandle inputs …
Inden for kunstig intelligens refererer robusthed til en models modstandsdygtighed over …
Inden for AI refererer ‘rate’ oftest til læringsraten, en hyperparameter, der …
Begrebet ‘hurtig’ beskriver den beregningsmæssige effektivitet inden for …
Efficiency is a critical metric in artificial intelligence that measures how well a model …
Inferens refererer til udrulningsfasen, hvor en færdig model bruges til at træffe …