Qwen2
Definition
Qwen2 markerar den andra betydande generationen av Qwen-modellfamiljen, med introduktion …
Terms tagged with Performance
Qwen2 markerar den andra betydande generationen av Qwen-modellfamiljen, med introduktion …
Träning med blandad precision (MPT) kombinerar halvprecision (FP16) och full precision …
Kimi K25 är en avancerad iteration inom Kimi-familjen av modeller producerade av Moonshot …
Komprimerade tensorer är multidimensionella arrayer som används inom djupinlärning där …
Inom AI-teknik optimerar caching prestandan genom att hålla senaste eller frekventa …
Asynkron bearbetning låter programvara utföra långvariga uppgifter, såsom I/O-operationer …
Detta område fokuserar på att påskynda grundläggande linjära algebra-bereknningar, som är …
Kvantisering omvandlar högprecisions flyttal (som FP32) till format med lägre precision …
Latens mäter en AI-tjänsts responsivitet, vanligtvis uttryckt i millisekunder. Det …
Distribuerad träning påskyndar modellkonvergens genom att parallellisera beräkningar över …
Inom artificiell intelligens innebär “i realtid” att ett system har förmågan …
Inom artificiell intelligens avser robusthet modellens motståndskraft mot adversariella …
Inom AI avser ‘rate’ oftast inlärningstakten, en hyperparameter som styr hur …
Begreppet ‘snabb’ beskriver beräkningsmässig effektivitet inom artificiell …
Effektivitet är en kritisk mätstorhet inom artificiell intelligens som mäter hur väl en …
Inferens avser deploymentsfasen där en färdigmodell används för att fatta beslut eller …