# Machine learning terms/All

> Source: https://aiwiki.ai/wiki/machine_learning_terms_all
> Summary: This alphabetical glossary collects core terminology used across machine learning, deep learning, reinforcement learning, large language models, and TensorFlow tooling. Each entry includes a short definition drawn from references such as the Google Machine Learning Glossary and Wikipedia.
> Updated: 2026-07-16
> Categories: Machine Learning
> License: CC BY 4.0 (https://creativecommons.org/licenses/by/4.0/) - attribute to "AI Wiki (aiwiki.ai)"
> Cite as: AI Wiki. "Machine learning terms/All." aiwiki.ai, 16 Jul 2026. https://aiwiki.ai/wiki/machine_learning_terms_all
> From AI Wiki (https://aiwiki.ai), the free encyclopedia of artificial intelligence. Reuse freely with attribution.

*See also: [Machine learning terms](https://aiwiki.ai/wiki/machine_learning_terms)*

This alphabetical glossary collects core terminology used across machine learning, [deep learning](https://aiwiki.ai/wiki/deep_learning), reinforcement learning, large language models, and TensorFlow tooling. Each entry includes a short definition drawn from references such as the Google Machine Learning Glossary and Wikipedia.[1][2] Terms are grouped by first letter for easier scanning.

## A

- **[A/B testing](https://aiwiki.ai/wiki/a_b_testing)**: Comparing two variants on randomly assigned users.
- **[accuracy](https://aiwiki.ai/wiki/accuracy)**: Fraction of correct predictions.
- **[action](https://aiwiki.ai/wiki/action)**: An RL agent's choice changing environment state.
- **[activation function](https://aiwiki.ai/wiki/activation_function)**: Nonlinearity applied to a neuron's weighted sum.
- **[active learning](https://aiwiki.ai/wiki/active_learning)**: Training where the model picks which examples to label.
- **[AdaGrad](https://aiwiki.ai/wiki/adagrad)**: Adaptive per-parameter learning rate optimizer.
- **[agent](https://aiwiki.ai/wiki/agent)**: RL entity acting in an environment for reward.
- **[agglomerative clustering](https://aiwiki.ai/wiki/agglomerative_clustering)**: Bottom-up hierarchical clustering.
- **[anomaly detection](https://aiwiki.ai/wiki/anomaly_detection)**: Spotting data points unlike typical patterns.
- **[AR](https://aiwiki.ai/wiki/ar)**: Augmented reality.
- **[area under the PR curve](https://aiwiki.ai/wiki/area_under_the_pr_curve)**: Summary of precision-recall tradeoff.
- **[area under the ROC curve](https://aiwiki.ai/wiki/area_under_the_roc_curve)**: Probability classifier ranks a positive above a negative.
- **[artificial general intelligence](https://aiwiki.ai/wiki/artificial_general_intelligence)**: Hypothetical human-level general AI.
- **[artificial intelligence](https://aiwiki.ai/wiki/artificial_intelligence)**: Field building machines that reason or perceive.
- **[attention](https://aiwiki.ai/wiki/attention)**: Mechanism weighting input parts when producing output.
- **[attention mechanism](https://aiwiki.ai/wiki/attention_mechanism)**: Query-key-value weighted sum used in transformers.
- **[attribute](https://aiwiki.ai/wiki/attribute)**: Synonym for feature.
- **[attribute sampling](https://aiwiki.ai/wiki/attribute_sampling)**: Random feature subset chosen at each tree split.
- **[AUC (Area under the ROC curve)](https://aiwiki.ai/wiki/auc_area_under_the_roc_curve)**: Threshold-independent classifier metric.
- **[augmented reality](https://aiwiki.ai/wiki/augmented_reality)**: Computer imagery overlaid on a real-world view.
- **[automation bias](https://aiwiki.ai/wiki/automation_bias)**: Favoring automated suggestions over other sources.
- **[autoencoder](https://aiwiki.ai/wiki/autoencoder)**: Network learning to reconstruct input through a bottleneck.
- **[average precision](https://aiwiki.ai/wiki/average_precision)**: Single-number precision-recall curve summary.
- **[axis-aligned condition](https://aiwiki.ai/wiki/axis-aligned_condition)**: Tree split on one feature against a threshold.

## B

- **[backpropagation](https://aiwiki.ai/wiki/backpropagation)**: Chain-rule gradient computation through a network.
- **[bagging](https://aiwiki.ai/wiki/bagging)**: Ensemble averaging models trained on bootstrapped subsets.
- **[bag of words](https://aiwiki.ai/wiki/bag_of_words)**: Text representation counting words, ignoring order.
- **[baseline](https://aiwiki.ai/wiki/baseline)**: Simple reference model for comparison.
- **[batch](https://aiwiki.ai/wiki/batch)**: Group of examples processed together.
- **[batch normalization](https://aiwiki.ai/wiki/batch_normalization)**: Normalizing activations per batch to stabilize training.
- **[batch size](https://aiwiki.ai/wiki/batch_size)**: Examples per gradient update.
- **[Bayesian neural network](https://aiwiki.ai/wiki/bayesian_neural_network)**: Network with distributions over weights.
- **[Bayesian optimization](https://aiwiki.ai/wiki/bayesian_optimization)**: [Hyperparameter tuning](https://aiwiki.ai/wiki/hyperparameter_tuning) with a probabilistic surrogate.
- **[Bellman equation](https://aiwiki.ai/wiki/bellman_equation)**: Recursive equation for optimal state value.
- **[BERT (Bidirectional Encoder Representations from Transformers)](https://aiwiki.ai/wiki/bert_bidirectional_encoder_representations_from_transformers)**: Transformer pretrained with masked language modeling.
- **[bias (ethics/fairness)](https://aiwiki.ai/wiki/bias_ethics_fairness)**: Unfair model preference across groups.
- **[bias (math) or bias term](https://aiwiki.ai/wiki/bias_math_or_bias_term)**: Learned constant added to a weighted sum.
- **[bigram](https://aiwiki.ai/wiki/bigram)**: Pair of adjacent tokens.
- **[bidirectional](https://aiwiki.ai/wiki/bidirectional)**: Processing sequences from both directions.
- **[bidirectional language model](https://aiwiki.ai/wiki/bidirectional_language_model)**: Model using context on both sides of each token.
- **[binary classification](https://aiwiki.ai/wiki/binary_classification)**: Classification with two possible classes.
- **[binary condition](https://aiwiki.ai/wiki/binary_condition)**: Tree test with two outcomes.
- **[binning](https://aiwiki.ai/wiki/binning)**: Mapping continuous values into discrete buckets.
- **[BLEU (Bilingual Evaluation Understudy)](https://aiwiki.ai/wiki/bleu_bilingual_evaluation_understudy)**: Translation metric on n-gram overlap.
- **[boosting](https://aiwiki.ai/wiki/boosting)**: Sequential ensemble correcting prior errors.
- **[bounding box](https://aiwiki.ai/wiki/bounding_box)**: Rectangle around a detected object.
- **[broadcasting](https://aiwiki.ai/wiki/broadcasting)**: Aligning tensor shapes for element-wise math.
- **[bucketing](https://aiwiki.ai/wiki/bucketing)**: Synonym for binning.

## C

- **[calibration layer](https://aiwiki.ai/wiki/calibration_layer)**: Adjusts predicted probabilities to match observed frequencies.
- **[candidate generation](https://aiwiki.ai/wiki/candidate_generation)**: First recommender stage selecting an item subset.
- **[candidate sampling](https://aiwiki.ai/wiki/candidate_sampling)**: Using a subset of negative classes in loss.
- **[categorical data](https://aiwiki.ai/wiki/categorical_data)**: Features with a small set of discrete values.
- **[causal language model](https://aiwiki.ai/wiki/causal_language_model)**: Predicts next token from past context only.
- **[centroid](https://aiwiki.ai/wiki/centroid)**: Center point of a cluster.
- **[centroid-based clustering](https://aiwiki.ai/wiki/centroid-based_clustering)**: Clustering represented by central points.
- **[chain of thought](https://aiwiki.ai/wiki/chain_of_thought)**: Prompting that elicits intermediate reasoning steps.
- **[checkpoint](https://aiwiki.ai/wiki/checkpoint)**: Saved snapshot of model parameters.
- **[class](https://aiwiki.ai/wiki/class)**: One discrete output category.
- **[classification model](https://aiwiki.ai/wiki/classification_model)**: Model predicting class labels.
- **[classification threshold](https://aiwiki.ai/wiki/classification_threshold)**: Probability cutoff for the positive class.
- **[class-imbalanced dataset](https://aiwiki.ai/wiki/class-imbalanced_dataset)**: Dataset with very unequal class frequencies.
- **[clipping](https://aiwiki.ai/wiki/clipping)**: Bounding values within a fixed range.
- **[Cloud TPU](https://aiwiki.ai/wiki/cloud_tpu)**: Google's cloud-hosted TPU service.[1]
- **[clustering](https://aiwiki.ai/wiki/clustering)**: Unsupervised grouping of similar examples.
- **[co-adaptation](https://aiwiki.ai/wiki/co-adaptation)**: Neurons depending on specific neighbors.
- **[collaborative filtering](https://aiwiki.ai/wiki/collaborative_filtering)**: Recommendations from patterns of many users.
- **[condition](https://aiwiki.ai/wiki/condition)**: Tree feature test choosing the next branch.
- **[confirmation bias](https://aiwiki.ai/wiki/confirmation_bias)**: Interpreting evidence to confirm existing beliefs.
- **[confusion matrix](https://aiwiki.ai/wiki/confusion_matrix)**: Table of predicted versus actual labels.
- **[continuous feature](https://aiwiki.ai/wiki/continuous_feature)**: Feature with any real value in an interval.
- **[convenience sampling](https://aiwiki.ai/wiki/convenience_sampling)**: Sampling from easily accessible sources.
- **[convergence](https://aiwiki.ai/wiki/convergence)**: State where further training barely changes loss.
- **[convex function](https://aiwiki.ai/wiki/convex_function)**: Function whose graph lies below any chord.
- **[convex optimization](https://aiwiki.ai/wiki/convex_optimization)**: Minimizing convex functions over convex sets.
- **[convex set](https://aiwiki.ai/wiki/convex_set)**: Set containing every segment between its points.
- **[convolution](https://aiwiki.ai/wiki/convolution)**: Sliding a filter over data to produce feature maps.
- **[convolutional filter](https://aiwiki.ai/wiki/convolutional_filter)**: Small weight matrix detecting a feature.
- **[convolutional layer](https://aiwiki.ai/wiki/convolutional_layer)**: Layer applying convolutional filters.
- **[convolutional neural network](https://aiwiki.ai/wiki/convolutional_neural_network)**: Network using convolutional layers, common for images.
- **[convolutional operation](https://aiwiki.ai/wiki/convolutional_operation)**: Multiply-and-sum as a filter slides over input.
- **[cost](https://aiwiki.ai/wiki/cost)**: Synonym for loss.
- **[co-training](https://aiwiki.ai/wiki/co-training)**: Two models on different views label data for each other.
- **[counterfactual fairness](https://aiwiki.ai/wiki/counterfactual_fairness)**: Predictions unchanged under altered sensitive attributes.
- **[coverage bias](https://aiwiki.ai/wiki/coverage_bias)**: Bias when sampling omits relevant subgroups.
- **[crash blossom](https://aiwiki.ai/wiki/crash_blossom)**: Ambiguous headline illustrating language parsing challenges.
- **[critic](https://aiwiki.ai/wiki/critic)**: Actor-critic value estimator guiding the actor.
- **[cross-entropy](https://aiwiki.ai/wiki/cross-entropy)**: Loss comparing predicted and true distributions.
- **[cross-validation](https://aiwiki.ai/wiki/cross-validation)**: Rotating which data fold is held out.

## D

- **[data analysis](https://aiwiki.ai/wiki/data_analysis)**: Inspecting data to guide modeling.
- **[data augmentation](https://aiwiki.ai/wiki/data_augmentation)**: Generating extra examples by transformation.
- **[DataFrame](https://aiwiki.ai/wiki/dataframe)**: Tabular labeled data structure used in pandas.
- **[data parallelism](https://aiwiki.ai/wiki/data_parallelism)**: Replicating a model across devices splitting the batch.
- **[data set or dataset](https://aiwiki.ai/wiki/data_set_or_dataset)**: Collection of examples used for training or evaluation.
- **[Dataset API (tf.data)](https://aiwiki.ai/wiki/dataset_api_tf_data)**: TensorFlow API for input pipelines.[1]
- **[decision boundary](https://aiwiki.ai/wiki/decision_boundary)**: Surface separating predicted classes.
- **[decision forest](https://aiwiki.ai/wiki/decision_forest)**: Ensemble of decision trees.
- **[decision threshold](https://aiwiki.ai/wiki/decision_threshold)**: Synonym for classification threshold.
- **[decision tree](https://aiwiki.ai/wiki/decision_tree)**: Model with branching feature tests.
- **[deep model](https://aiwiki.ai/wiki/deep_model)**: Network with many hidden layers.
- **[decoder](https://aiwiki.ai/wiki/decoder)**: Encoder-decoder part generating outputs from a representation.
- **[deep neural network](https://aiwiki.ai/wiki/deep_neural_network)**: Network with many stacked hidden layers.[4]
- **[Deep Q-Network (DQN)](https://aiwiki.ai/wiki/deep_q-network_dqn)**: Deep network approximating the Q-function.
- **[demographic parity](https://aiwiki.ai/wiki/demographic_parity)**: Equal positive prediction rates across groups.
- **[denoising](https://aiwiki.ai/wiki/denoising)**: Removing noise or reconstructing clean signal.
- **[dense feature](https://aiwiki.ai/wiki/dense_feature)**: Feature with mostly nonzero values.
- **[dense layer](https://aiwiki.ai/wiki/dense_layer)**: Layer connecting every input to every output.
- **[depth](https://aiwiki.ai/wiki/depth)**: Number of layers in a network.
- **[depthwise separable convolutional neural network (sepCNN)](https://aiwiki.ai/wiki/depthwise_separable_convolutional_neural_network_sepcnn)**: Efficient CNN factorizing convolutions.
- **[derived label](https://aiwiki.ai/wiki/derived_label)**: Label computed from other data.
- **[device](https://aiwiki.ai/wiki/device)**: CPU, GPU, or TPU running operations.
- **[diffusion model](https://aiwiki.ai/wiki/diffusion_model)**: Generative model reversing a noising process.
- **[dimension reduction](https://aiwiki.ai/wiki/dimension_reduction)**: Mapping data to fewer dimensions preserving structure.
- **[dimensions](https://aiwiki.ai/wiki/dimensions)**: Independent axes of a tensor.
- **[discrete feature](https://aiwiki.ai/wiki/discrete_feature)**: Feature with countable possible values.
- **[discriminative model](https://aiwiki.ai/wiki/discriminative_model)**: Model learning conditional probability of labels.
- **[discriminator](https://aiwiki.ai/wiki/discriminator)**: GAN network distinguishing real from fake.
- **[disparate impact](https://aiwiki.ai/wiki/disparate_impact)**: Decisions disproportionately harming a protected group.
- **[disparate treatment](https://aiwiki.ai/wiki/disparate_treatment)**: Direct use of sensitive attributes in decisions.
- **[divisive clustering](https://aiwiki.ai/wiki/divisive_clustering)**: Top-down hierarchical clustering.
- **[downsampling](https://aiwiki.ai/wiki/downsampling)**: Reducing data rate or majority-class count.
- **[DQN](https://aiwiki.ai/wiki/dqn)**: Abbreviation for Deep Q-Network.
- **[dropout regularization](https://aiwiki.ai/wiki/dropout_regularization)**: Randomly zeroing neurons during training.
- **[dynamic](https://aiwiki.ai/wiki/dynamic)**: Continuously updated rather than static.
- **[dynamic model](https://aiwiki.ai/wiki/dynamic_model)**: Model retrained continuously as data arrives.

## E

- **[eager execution](https://aiwiki.ai/wiki/eager_execution)**: TensorFlow mode running ops immediately.[1]
- **[early stopping](https://aiwiki.ai/wiki/early_stopping)**: Stopping when validation loss stops improving.
- **[earth mover's distance (EMD)](https://aiwiki.ai/wiki/earth_mover_s_distance_emd)**: Distance based on minimum transport cost between distributions.
- **[embedding](https://aiwiki.ai/wiki/embedding)**: Learned dense vector for a discrete object.
- **[embedding layer](https://aiwiki.ai/wiki/embedding_layer)**: Maps discrete tokens to dense vectors.
- **[embedding space](https://aiwiki.ai/wiki/embedding_space)**: Vector space where geometry reflects similarity.
- **[embedding vector](https://aiwiki.ai/wiki/embedding_vector)**: Dense vector for one item.
- **[empirical risk minimization (ERM)](https://aiwiki.ai/wiki/empirical_risk_minimization_erm)**: Choosing a model that minimizes average training loss.
- **[encoder](https://aiwiki.ai/wiki/encoder)**: Maps inputs to a fixed-size representation.
- **[ensemble](https://aiwiki.ai/wiki/ensemble)**: Combination of several models' predictions.
- **[entropy](https://aiwiki.ai/wiki/entropy)**: Uncertainty measure of a distribution.
- **[environment](https://aiwiki.ai/wiki/environment)**: System an RL agent acts within.
- **[episode](https://aiwiki.ai/wiki/episode)**: One full RL run from start to terminal.
- **[epoch](https://aiwiki.ai/wiki/epoch)**: One full pass through the training data.
- **[epsilon greedy policy](https://aiwiki.ai/wiki/epsilon_greedy_policy)**: Greedy mostly but explores with probability epsilon.
- **[equality of opportunity](https://aiwiki.ai/wiki/equality_of_opportunity)**: Equal true positive rates across groups.
- **[equalized odds](https://aiwiki.ai/wiki/equalized_odds)**: Equal true and false positive rates across groups.
- **[Estimator](https://aiwiki.ai/wiki/estimator)**: TensorFlow high-level model API.[1]
- **[example](https://aiwiki.ai/wiki/example)**: One data instance fed to a model.
- **[experience replay](https://aiwiki.ai/wiki/experience_replay)**: Sampling stored RL transitions for training.
- **[experimenter's bias](https://aiwiki.ai/wiki/experimenter_s_bias)**: Researcher expectations influencing data or analysis.
- **[exploding gradient problem](https://aiwiki.ai/wiki/exploding_gradient_problem)**: Gradients growing uncontrollably during backprop.

## F

- **[fairness constraint](https://aiwiki.ai/wiki/fairness_constraint)**: Formal restriction enforcing a fairness criterion.
- **[fairness metric](https://aiwiki.ai/wiki/fairness_metric)**: Measure of behavior across protected groups.
- **[false negative (FN)](https://aiwiki.ai/wiki/false_negative_fn)**: Negative prediction with positive truth.
- **[false negative rate](https://aiwiki.ai/wiki/false_negative_rate)**: Fraction of actual positives missed.
- **[false positive (FP)](https://aiwiki.ai/wiki/false_positive_fp)**: Positive prediction with negative truth.
- **[false positive rate (FPR)](https://aiwiki.ai/wiki/false_positive_rate_fpr)**: Fraction of negatives misclassified positive.
- **[feature](https://aiwiki.ai/wiki/feature)**: Measurable input variable used by a model.
- **[feature cross](https://aiwiki.ai/wiki/feature_cross)**: Synthetic feature from combining features.
- **[feature engineering](https://aiwiki.ai/wiki/feature_engineering)**: Designing features to improve performance.
- **[feature extraction](https://aiwiki.ai/wiki/feature_extraction)**: Computing informative variables from raw data.
- **[feature importances](https://aiwiki.ai/wiki/feature_importances)**: Scores of each feature's contribution.
- **[feature set](https://aiwiki.ai/wiki/feature_set)**: Features used by a particular model.
- **[feature spec](https://aiwiki.ai/wiki/feature_spec)**: Description of feature names and types.
- **[feature vector](https://aiwiki.ai/wiki/feature_vector)**: Ordered list of feature values for one example.
- **[federated learning](https://aiwiki.ai/wiki/federated_learning)**: Training across devices that keep data local.
- **[feedback loop](https://aiwiki.ai/wiki/feedback_loop)**: When predictions influence future training data.
- **[feedforward neural network (FFN)](https://aiwiki.ai/wiki/feedforward_neural_network_ffn)**: Network with connections only forward.
- **[few-shot learning](https://aiwiki.ai/wiki/few-shot_learning)**: Task performance from a few examples.
- **[fine tuning](https://aiwiki.ai/wiki/fine_tuning)**: Continuing training of a pretrained model.
- **[foundation model](https://aiwiki.ai/wiki/foundation_model)**: Large pretrained model adaptable to many tasks.
- **[forget gate](https://aiwiki.ai/wiki/forget_gate)**: LSTM gate discarding cell-state information.
- **[full softmax](https://aiwiki.ai/wiki/full_softmax)**: Softmax over the entire vocabulary.
- **[fully connected layer](https://aiwiki.ai/wiki/fully_connected_layer)**: Synonym for dense layer.

## G

- **[GAN](https://aiwiki.ai/wiki/gan)**: Abbreviation for generative adversarial network.
- **[generalization](https://aiwiki.ai/wiki/generalization)**: Performance on unseen data.
- **[generalization curve](https://aiwiki.ai/wiki/generalization_curve)**: Plot of training versus validation loss.
- **[generalized linear model](https://aiwiki.ai/wiki/generalized_linear_model)**: Linear model with link function.
- **[generative adversarial network (GAN)](https://aiwiki.ai/wiki/generative_adversarial_network_gan)**: Generator trained against a discriminator.
- **[generative AI](https://aiwiki.ai/wiki/generative_ai)**: AI producing new content like text or images.
- **[generative model](https://aiwiki.ai/wiki/generative_model)**: Model of the joint distribution able to synthesize samples.
- **[generator](https://aiwiki.ai/wiki/generator)**: GAN network producing [synthetic data](https://aiwiki.ai/wiki/synthetic_data).
- **[GPT (Generative Pre-trained Transformer)](https://aiwiki.ai/wiki/gpt_generative_pre-trained_transformer)**: Autoregressive transformer family from OpenAI.
- **[gini impurity](https://aiwiki.ai/wiki/gini_impurity)**: Misclassification probability at a tree node.
- **[gradient](https://aiwiki.ai/wiki/gradient)**: Vector of partial derivatives indicating steepest ascent.
- **[gradient boosting](https://aiwiki.ai/wiki/gradient_boosting)**: Boosting fitting each model to loss gradient.
- **[gradient boosted (decision) trees (GBT)](https://aiwiki.ai/wiki/gradient_boosted_decision_trees_gbt)**: Gradient boosting using shallow trees.
- **[gradient clipping](https://aiwiki.ai/wiki/gradient_clipping)**: Capping gradient magnitudes during training.
- **[gradient descent](https://aiwiki.ai/wiki/gradient_descent)**: Optimization stepping opposite the loss gradient.
- **[graph](https://aiwiki.ai/wiki/graph)**: TensorFlow computation representation of nodes and edges.[1]
- **[graph execution](https://aiwiki.ai/wiki/graph_execution)**: Running a precompiled TensorFlow graph.[1]
- **[greedy policy](https://aiwiki.ai/wiki/greedy_policy)**: Always picking the highest-valued action.
- **[ground truth](https://aiwiki.ai/wiki/ground_truth)**: Correct label for an example.
- **[group attribution bias](https://aiwiki.ai/wiki/group_attribution_bias)**: Assuming individuals match their group's traits.

## H

- **[hallucination](https://aiwiki.ai/wiki/hallucination)**: Fluent but factually incorrect generative output.
- **[hashing](https://aiwiki.ai/wiki/hashing)**: Mapping inputs to fixed-size integers.
- **[heuristic](https://aiwiki.ai/wiki/heuristic)**: Rule of thumb without optimality guarantee.
- **[hidden layer](https://aiwiki.ai/wiki/hidden_layer)**: Layer between input and output.
- **[hierarchical clustering](https://aiwiki.ai/wiki/hierarchical_clustering)**: Clustering forming a tree of nested groups.
- **[hinge loss](https://aiwiki.ai/wiki/hinge_loss)**: SVM margin-based loss.
- **[holdout data](https://aiwiki.ai/wiki/holdout_data)**: Examples reserved for final evaluation.
- **[hyperparameter](https://aiwiki.ai/wiki/hyperparameter)**: Training setting chosen before optimization.
- **[hyperplane](https://aiwiki.ai/wiki/hyperplane)**: Flat decision surface in feature space.

## I

- **[i.i.d.](https://aiwiki.ai/wiki/i_i_d)**: Independent and identically distributed.
- **[image recognition](https://aiwiki.ai/wiki/image_recognition)**: Identifying content within images.
- **[imbalanced dataset](https://aiwiki.ai/wiki/imbalanced_dataset)**: Dataset with very unequal class counts.
- **[implicit bias](https://aiwiki.ai/wiki/implicit_bias)**: Unconscious attitudes affecting data work.
- **[incompatibility of fairness metrics](https://aiwiki.ai/wiki/incompatibility_of_fairness_metrics)**: Theorem that some fairness criteria cannot coexist.
- **[independently and identically distributed (i.i.d)](https://aiwiki.ai/wiki/independently_and_identically_distributed_i_i_d)**: Examples drawn independently from one distribution.
- **[individual fairness](https://aiwiki.ai/wiki/individual_fairness)**: Similar individuals get similar predictions.
- **[inference](https://aiwiki.ai/wiki/inference)**: Using a trained model to predict.
- **[inference path](https://aiwiki.ai/wiki/inference_path)**: Tree conditions an example follows to a leaf.
- **[information gain](https://aiwiki.ai/wiki/information_gain)**: Entropy reduction from splitting on a feature.
- **[in-group bias](https://aiwiki.ai/wiki/in-group_bias)**: Favoring members of one's own group.
- **[input layer](https://aiwiki.ai/wiki/input_layer)**: First network layer receiving features.
- **[in-set condition](https://aiwiki.ai/wiki/in-set_condition)**: Tree test on set membership.
- **[instance](https://aiwiki.ai/wiki/instance)**: Synonym for example.
- **[interpretability](https://aiwiki.ai/wiki/interpretability)**: How understandable model reasoning is.
- **[inter-rater agreement](https://aiwiki.ai/wiki/inter-rater_agreement)**: How often labelers agree on labels.
- **[intersection over union (IoU)](https://aiwiki.ai/wiki/intersection_over_union_iou)**: Overlap-to-union ratio between regions.
- **[IoU](https://aiwiki.ai/wiki/iou)**: Abbreviation for intersection over union.
- **[item matrix](https://aiwiki.ai/wiki/item_matrix)**: Factor matrix for items in matrix factorization.
- **[items](https://aiwiki.ai/wiki/items)**: Objects suggested by a recommender.
- **[iteration](https://aiwiki.ai/wiki/iteration)**: One parameter update from one batch.

## K

- **[Keras](https://aiwiki.ai/wiki/keras)**: High-level neural network Python API.[1]
- **[keypoints](https://aiwiki.ai/wiki/keypoints)**: Distinctive image points used for pose or matching.
- **[Kernel Support Vector Machines (KSVMs)](https://aiwiki.ai/wiki/kernel_support_vector_machines_ksvms)**: SVMs using kernels in implicit feature spaces.
- **[k-means](https://aiwiki.ai/wiki/k-means)**: Clustering by alternating assignment and centroid update.
- **[k-median](https://aiwiki.ai/wiki/k-median)**: Clustering using medians instead of means.

## L

- **[L0 regularization](https://aiwiki.ai/wiki/l0_regularization)**: Penalty on nonzero weight count.
- **[L1 loss](https://aiwiki.ai/wiki/l1_loss)**: Sum of absolute prediction errors.
- **[L1 regularization](https://aiwiki.ai/wiki/l1_regularization)**: Penalty on absolute weights producing sparsity.
- **[L2 loss](https://aiwiki.ai/wiki/l2_loss)**: Sum of squared prediction errors.
- **[L2 regularization](https://aiwiki.ai/wiki/l2_regularization)**: Penalty on squared weights encouraging small values.
- **[label](https://aiwiki.ai/wiki/label)**: Correct output for an example.
- **[labeled example](https://aiwiki.ai/wiki/labeled_example)**: Example with features and a known label.
- **[LaMDA (Language Model for Dialogue Applications)](https://aiwiki.ai/wiki/lamda_language_model_for_dialogue_applications)**: Google conversational language model.[1]
- **[lambda](https://aiwiki.ai/wiki/lambda)**: Hyperparameter controlling regularization strength.
- **[landmarks](https://aiwiki.ai/wiki/landmarks)**: Named coordinate points annotated on images.
- **[language model](https://aiwiki.ai/wiki/language_model)**: Assigns probability to token sequences.
- **[large language model](https://aiwiki.ai/wiki/large_language_model)**: Language model with billions of parameters.
- **[layer](https://aiwiki.ai/wiki/layer)**: Group of neurons or ops at a network stage.
- **[Layers API (tf.layers)](https://aiwiki.ai/wiki/layers_api_tf_layers)**: TensorFlow reusable building blocks.[1]
- **[leaf](https://aiwiki.ai/wiki/leaf)**: Terminal tree node producing a prediction.
- **[learning rate](https://aiwiki.ai/wiki/learning_rate)**: Step size for gradient updates.
- **[least squares regression](https://aiwiki.ai/wiki/least_squares_regression)**: Regression minimizing squared residuals.
- **[linear model](https://aiwiki.ai/wiki/linear_model)**: Predictions as a weighted sum plus bias.
- **[linear](https://aiwiki.ai/wiki/linear)**: Expressible as a weighted sum.
- **[linear regression](https://aiwiki.ai/wiki/linear_regression)**: Linear function predicting a continuous value.
- **[logistic regression](https://aiwiki.ai/wiki/logistic_regression)**: Classifier using a logistic function on a linear sum.
- **[logits](https://aiwiki.ai/wiki/logits)**: Raw scores before softmax or sigmoid.
- **[Log Loss](https://aiwiki.ai/wiki/log_loss)**: Logistic regression loss, equivalent to binary cross-entropy.
- **[log-odds](https://aiwiki.ai/wiki/log-odds)**: Log ratio of two outcome probabilities.
- **[Long Short-Term Memory (LSTM)](https://aiwiki.ai/wiki/long_short-term_memory_lstm)**: Gated recurrent unit for long-range dependencies.
- **[LoRA](https://aiwiki.ai/wiki/lora)**: Low-rank adapter for parameter-efficient fine-tuning.
- **[loss](https://aiwiki.ai/wiki/loss)**: Quantity measuring prediction error.
- **[loss curve](https://aiwiki.ai/wiki/loss_curve)**: Plot of loss over training steps.
- **[loss function](https://aiwiki.ai/wiki/loss_function)**: Formula aggregating prediction errors into a loss.
- **[loss surface](https://aiwiki.ai/wiki/loss_surface)**: Landscape of loss across parameter values.
- **[LSTM](https://aiwiki.ai/wiki/lstm)**: Abbreviation for Long Short-Term Memory.

## M

- **[machine learning](https://aiwiki.ai/wiki/machine_learning)**: Building systems that learn patterns from data.[3][5]
- **[majority class](https://aiwiki.ai/wiki/majority_class)**: Most frequent class in an imbalanced dataset.
- **[Markov decision process (MDP)](https://aiwiki.ai/wiki/markov_decision_process_mdp)**: RL model of states, actions, transitions, rewards.
- **[Markov property](https://aiwiki.ai/wiki/markov_property)**: Future depends only on current state.
- **[masked language model](https://aiwiki.ai/wiki/masked_language_model)**: Predicts hidden tokens given context.
- **[matplotlib](https://aiwiki.ai/wiki/matplotlib)**: Python plotting library.
- **[matrix factorization](https://aiwiki.ai/wiki/matrix_factorization)**: Decomposing a matrix into smaller factor matrices.
- **[Mean Absolute Error (MAE)](https://aiwiki.ai/wiki/mean_absolute_error_mae)**: Average of absolute prediction errors.
- **[Mean Squared Error (MSE)](https://aiwiki.ai/wiki/mean_squared_error_mse)**: Average of squared prediction errors.
- **[metric](https://aiwiki.ai/wiki/metric)**: Scalar summarizing model performance.
- **[meta-learning](https://aiwiki.ai/wiki/meta-learning)**: Learning algorithms that learn new tasks quickly.
- **[Metrics API (tf.metrics)](https://aiwiki.ai/wiki/metrics_api_tf_metrics)**: TensorFlow standard metrics module.[1]
- **[mini-batch](https://aiwiki.ai/wiki/mini-batch)**: Small group of examples for one update.
- **[mini-batch stochastic gradient descent](https://aiwiki.ai/wiki/mini-batch_stochastic_gradient_descent)**: Gradient descent using mini-batches.
- **[minimax loss](https://aiwiki.ai/wiki/minimax_loss)**: Two-player adversarial GAN objective.
- **[minority class](https://aiwiki.ai/wiki/minority_class)**: Less frequent class in imbalanced data.
- **[mixture of experts](https://aiwiki.ai/wiki/mixture_of_experts)**: Architecture routing inputs to specialized sub-networks.
- **[ML](https://aiwiki.ai/wiki/ml)**: Abbreviation for machine learning.
- **[MNIST](https://aiwiki.ai/wiki/mnist)**: Classic handwritten digit benchmark dataset.
- **[modality](https://aiwiki.ai/wiki/modality)**: A data type such as text, image, or audio.
- **[model](https://aiwiki.ai/wiki/model)**: Object mapping inputs to predictions via learned parameters.
- **[model capacity](https://aiwiki.ai/wiki/model_capacity)**: Range of functions a model can represent.
- **[model parallelism](https://aiwiki.ai/wiki/model_parallelism)**: Splitting a model across devices.
- **[model training](https://aiwiki.ai/wiki/model_training)**: Fitting model parameters to data.
- **[Momentum](https://aiwiki.ai/wiki/momentum)**: Optimizer using moving average of gradients.
- **[multi-class classification](https://aiwiki.ai/wiki/multi-class_classification)**: Classification with more than two classes.
- **[multi-class logistic regression](https://aiwiki.ai/wiki/multi-class_logistic_regression)**: Logistic regression with softmax across classes.
- **[multi-head self-attention](https://aiwiki.ai/wiki/multi-head_self-attention)**: Parallel self-attention operations concatenated.
- **[multimodal model](https://aiwiki.ai/wiki/multimodal_model)**: Model handling multiple data modalities.
- **[multinomial classification](https://aiwiki.ai/wiki/multinomial_classification)**: Synonym for multi-class classification.
- **[multinomial regression](https://aiwiki.ai/wiki/multinomial_regression)**: Regression for probabilities across categories.

## N

- **[NaN trap](https://aiwiki.ai/wiki/nan_trap)**: Activations becoming NaN and spreading.
- **[natural language understanding](https://aiwiki.ai/wiki/natural_language_understanding)**: NLP subfield extracting meaning from text.
- **[negative class](https://aiwiki.ai/wiki/negative_class)**: Class without the tested condition.
- **[neural network](https://aiwiki.ai/wiki/neural_network)**: Connected layers of weighted units.
- **[neuron](https://aiwiki.ai/wiki/neuron)**: Single unit computing weighted sum plus activation.
- **[N-gram](https://aiwiki.ai/wiki/n-gram)**: Sequence of n adjacent tokens.
- **[NLU](https://aiwiki.ai/wiki/nlu)**: Abbreviation for natural language understanding.
- **[node (neural network)](https://aiwiki.ai/wiki/node_neural_network)**: Synonym for a neuron.
- **[node (TensorFlow graph)](https://aiwiki.ai/wiki/node_tensorflow_graph)**: Single op in a TensorFlow graph.[1]
- **[node (decision tree)](https://aiwiki.ai/wiki/node_decision_tree)**: Point in a tree with a test or leaf.
- **[noise](https://aiwiki.ai/wiki/noise)**: Random variation not reflecting the underlying signal.
- **[non-binary condition](https://aiwiki.ai/wiki/non-binary_condition)**: Tree test with more than two outcomes.
- **[nonlinear](https://aiwiki.ai/wiki/nonlinear)**: Not expressible as a weighted sum.
- **[non-response bias](https://aiwiki.ai/wiki/non-response_bias)**: Bias from groups responding to surveys less often.
- **[nonstationarity](https://aiwiki.ai/wiki/nonstationarity)**: Data statistics changing over time.
- **[normalization](https://aiwiki.ai/wiki/normalization)**: Rescaling values to a standard range.
- **[novelty detection](https://aiwiki.ai/wiki/novelty_detection)**: Identifying observations unlike training cases.
- **[numerical data](https://aiwiki.ai/wiki/numerical_data)**: Features represented as numbers.
- **[NumPy](https://aiwiki.ai/wiki/numpy)**: Python array computing library.

## O

- **[objective](https://aiwiki.ai/wiki/objective)**: Quantity an algorithm optimizes.
- **[objective function](https://aiwiki.ai/wiki/objective_function)**: Function optimized during training.
- **[oblique condition](https://aiwiki.ai/wiki/oblique_condition)**: Tree split on a linear feature combination.
- **[offline](https://aiwiki.ai/wiki/offline)**: Performed in batch, not in real time.
- **[offline inference](https://aiwiki.ai/wiki/offline_inference)**: Predicting in advance and storing results.
- **[one-hot encoding](https://aiwiki.ai/wiki/one-hot_encoding)**: Category as a vector with a single 1.
- **[one-shot learning](https://aiwiki.ai/wiki/one-shot_learning)**: Learning from a single labeled example.
- **[one-vs.-all](https://aiwiki.ai/wiki/one-vs_-all)**: Multi-class via one binary classifier per class.
- **[online](https://aiwiki.ai/wiki/online)**: Processing data as it arrives.
- **[online inference](https://aiwiki.ai/wiki/online_inference)**: Predicting in real time on requests.
- **[operation (op)](https://aiwiki.ai/wiki/operation_op)**: Named computation in a TensorFlow graph.[1]
- **[out-of-bag evaluation (OOB evaluation)](https://aiwiki.ai/wiki/out-of-bag_evaluation_oob_evaluation)**: Ensemble accuracy from unsampled examples.
- **[optimizer](https://aiwiki.ai/wiki/optimizer)**: Algorithm updating parameters from gradients.
- **[out-group homogeneity bias](https://aiwiki.ai/wiki/out-group_homogeneity_bias)**: Seeing outside groups as more uniform.
- **[outlier detection](https://aiwiki.ai/wiki/outlier_detection)**: Identifying examples far from typical data.
- **[outliers](https://aiwiki.ai/wiki/outliers)**: Examples with very atypical values.
- **[output layer](https://aiwiki.ai/wiki/output_layer)**: Final network layer producing predictions.
- **[overfitting](https://aiwiki.ai/wiki/overfitting)**: Fitting training data but failing to generalize.
- **[oversampling](https://aiwiki.ai/wiki/oversampling)**: Adding minority examples to balance classes.

## P

- **[pandas](https://aiwiki.ai/wiki/pandas)**: Python tabular data analysis library.
- **[parameter](https://aiwiki.ai/wiki/parameter)**: Value learned during training.
- **[Parameter Server (PS)](https://aiwiki.ai/wiki/parameter_server_ps)**: [Distributed training](https://aiwiki.ai/wiki/distributed_training) architecture with shared servers.
- **[parameter update](https://aiwiki.ai/wiki/parameter_update)**: One optimizer step changing parameters.
- **[partial derivative](https://aiwiki.ai/wiki/partial_derivative)**: Derivative with respect to one variable.
- **[participation bias](https://aiwiki.ai/wiki/participation_bias)**: Bias when individuals choose to be included.
- **[partitioning strategy](https://aiwiki.ai/wiki/partitioning_strategy)**: Method splitting variables across machines.
- **[perceptron](https://aiwiki.ai/wiki/perceptron)**: Single-layer binary classifier.
- **[performance](https://aiwiki.ai/wiki/performance)**: Model quality or running speed.
- **[permutation variable importances](https://aiwiki.ai/wiki/permutation_variable_importances)**: Importance from shuffling a feature.
- **[perplexity](https://aiwiki.ai/wiki/perplexity)**: Language model surprise metric on held-out text.
- **[pipeline](https://aiwiki.ai/wiki/pipeline)**: Sequence of processing and modeling steps.
- **[pipelining](https://aiwiki.ai/wiki/pipelining)**: Overlapping execution stages for throughput.
- **[policy](https://aiwiki.ai/wiki/policy)**: RL mapping from states to actions.
- **[pooling](https://aiwiki.ai/wiki/pooling)**: CNN downsampling over local regions.
- **[positive class](https://aiwiki.ai/wiki/positive_class)**: Class with the tested condition present.
- **[post-processing](https://aiwiki.ai/wiki/post-processing)**: Steps applied to model output.
- **[PR AUC (area under the PR curve)](https://aiwiki.ai/wiki/pr_auc_area_under_the_pr_curve)**: Summary of precision-recall curve.
- **[precision](https://aiwiki.ai/wiki/precision)**: Fraction of predicted positives that are correct.
- **[precision-recall curve](https://aiwiki.ai/wiki/precision-recall_curve)**: Plot of precision versus recall tradeoff.
- **[prediction](https://aiwiki.ai/wiki/prediction)**: Output a model produces for an input.
- **[prediction bias](https://aiwiki.ai/wiki/prediction_bias)**: Average prediction minus average label.
- **[predictive parity](https://aiwiki.ai/wiki/predictive_parity)**: Equal precision across groups.
- **[predictive rate parity](https://aiwiki.ai/wiki/predictive_rate_parity)**: Equal positive predictive values across groups.
- **[preprocessing](https://aiwiki.ai/wiki/preprocessing)**: Transforming raw data for training.
- **[pre-trained model](https://aiwiki.ai/wiki/pre-trained_model)**: Model previously trained on a large dataset.
- **[prior belief](https://aiwiki.ai/wiki/prior_belief)**: Initial assumption about parameters.
- **[probabilistic regression model](https://aiwiki.ai/wiki/probabilistic_regression_model)**: Regression outputting a target distribution.
- **[prompt engineering](https://aiwiki.ai/wiki/prompt_engineering)**: Designing inputs to guide language model output.
- **[proxy (sensitive attributes)](https://aiwiki.ai/wiki/proxy_sensitive_attributes)**: Feature correlating with a sensitive attribute.
- **[proxy labels](https://aiwiki.ai/wiki/proxy_labels)**: Substitute targets when true labels are unavailable.

## Q

- **[Q-function](https://aiwiki.ai/wiki/q-function)**: Expected return from action in a state under policy.
- **[Q-learning](https://aiwiki.ai/wiki/q-learning)**: Value-based RL learning the Q-function.
- **[quantile](https://aiwiki.ai/wiki/quantile)**: Value below which a fraction of observations fall.
- **[quantile bucketing](https://aiwiki.ai/wiki/quantile_bucketing)**: Binning with equal counts per bucket.
- **[quantization](https://aiwiki.ai/wiki/quantization)**: Reducing numerical precision of weights or activations.
- **[queue](https://aiwiki.ai/wiki/queue)**: Structure holding inputs awaiting processing.

## R

- **[random forest](https://aiwiki.ai/wiki/random_forest)**: Ensemble of trees with random feature subsets.
- **[random policy](https://aiwiki.ai/wiki/random_policy)**: Policy choosing actions uniformly at random.
- **[ranking](https://aiwiki.ai/wiki/ranking)**: Ordering items by relevance.
- **[rank (ordinality)](https://aiwiki.ai/wiki/rank_ordinality)**: Position of an item in a sorted list.
- **[rank (Tensor)](https://aiwiki.ai/wiki/rank_tensor)**: Number of tensor dimensions.
- **[rater](https://aiwiki.ai/wiki/rater)**: Person labeling examples for training data.
- **[recall](https://aiwiki.ai/wiki/recall)**: Fraction of actual positives correctly identified.
- **[recommendation system](https://aiwiki.ai/wiki/recommender_system)**: System suggesting items of interest to users.
- **[Rectified Linear Unit (ReLU)](https://aiwiki.ai/wiki/rectified_linear_unit_relu)**: Activation returning input if positive, else zero.
- **[recurrent neural network](https://aiwiki.ai/wiki/recurrent_neural_network)**: Sequence network with hidden state.
- **[regression model](https://aiwiki.ai/wiki/regression_model)**: Model predicting continuous values.
- **[regularization](https://aiwiki.ai/wiki/regularization)**: Penalizing complexity to reduce overfitting.
- **[regularization rate](https://aiwiki.ai/wiki/regularization_rate)**: Hyperparameter for regularization strength.
- **[reinforcement learning (RL)](https://aiwiki.ai/wiki/reinforcement_learning_rl)**: Learning by interaction to maximize reward.
- **[reinforcement learning from human feedback](https://aiwiki.ai/wiki/reinforcement_learning_from_human_feedback)**: Fine-tuning models from human preference data.
- **[ReLU](https://aiwiki.ai/wiki/relu)**: Abbreviation for Rectified Linear Unit.
- **[replay buffer](https://aiwiki.ai/wiki/replay_buffer)**: Memory of past RL transitions.
- **[reporting bias](https://aiwiki.ai/wiki/reporting_bias)**: Bias from unrepresentative event reporting.
- **[representation](https://aiwiki.ai/wiki/representation)**: How examples are encoded as numbers.
- **[re-ranking](https://aiwiki.ai/wiki/re-ranking)**: Second pass refining candidate order.
- **[retrieval augmented generation](https://aiwiki.ai/wiki/retrieval_augmented_generation)**: Combining language models with document retrieval.
- **[return](https://aiwiki.ai/wiki/return)**: Cumulative discounted RL reward.
- **[reward](https://aiwiki.ai/wiki/reward)**: RL feedback signal after an action.
- **[ridge regularization](https://aiwiki.ai/wiki/ridge_regularization)**: Synonym for L2 regularization.
- **[RLHF](https://aiwiki.ai/wiki/rlhf)**: Abbreviation for reinforcement learning from human feedback.
- **[RNN](https://aiwiki.ai/wiki/rnn)**: Abbreviation for recurrent neural network.
- **[ROC (receiver operating characteristic) Curve](https://aiwiki.ai/wiki/roc_receiver_operating_characteristic_curve)**: Plot of TPR versus FPR across thresholds.
- **[root](https://aiwiki.ai/wiki/root)**: Top decision tree node.
- **[root directory](https://aiwiki.ai/wiki/root_directory)**: Base folder for files like checkpoints.
- **[Root Mean Squared Error (RMSE)](https://aiwiki.ai/wiki/root_mean_squared_error_rmse)**: Square root of mean squared error.
- **[rotational invariance](https://aiwiki.ai/wiki/rotational_invariance)**: Predictions unchanged under input rotation.

## S

- **[sampling bias](https://aiwiki.ai/wiki/sampling_bias)**: Sampled data unrepresentative of population.
- **[sampling with replacement](https://aiwiki.ai/wiki/sampling_with_replacement)**: Sampling where examples can repeat.
- **[SavedModel](https://aiwiki.ai/wiki/savedmodel)**: TensorFlow serialization format for complete models.[1]
- **[Saver](https://aiwiki.ai/wiki/saver)**: TensorFlow class for variable checkpoints.[1]
- **[scalar](https://aiwiki.ai/wiki/scalar)**: Tensor of rank zero, one number.
- **[scaling](https://aiwiki.ai/wiki/scaling)**: Adjusting feature value ranges.
- **[scikit-learn](https://aiwiki.ai/wiki/scikit-learn)**: Python classical machine learning library.[6]
- **[scoring](https://aiwiki.ai/wiki/scoring)**: Producing numeric scores for candidates.
- **[selection bias](https://aiwiki.ai/wiki/selection_bias)**: Selection correlating with outcomes.
- **[self-attention (also called self-attention layer)](https://aiwiki.ai/wiki/self-attention_also_called_self-attention_layer)**: Attention within one sequence.
- **[self-supervised learning](https://aiwiki.ai/wiki/self-supervised_learning)**: Generating labels from the input itself.
- **[self-training](https://aiwiki.ai/wiki/self-training)**: Using confident predictions as new labels.
- **[semi-supervised learning](https://aiwiki.ai/wiki/semi-supervised_learning)**: Mixing labeled and unlabeled data.
- **[sensitive attribute](https://aiwiki.ai/wiki/sensitive_attribute)**: Feature treated specially for fairness.
- **[sentiment analysis](https://aiwiki.ai/wiki/sentiment_analysis)**: Classifying text by emotional attitude.
- **[sequence model](https://aiwiki.ai/wiki/sequence_model)**: Model for ordered sequences.
- **[sequence-to-sequence task](https://aiwiki.ai/wiki/sequence-to-sequence_task)**: Task with sequence input and output.
- **[serving](https://aiwiki.ai/wiki/serving)**: Deploying a model to answer requests.
- **[shape (Tensor)](https://aiwiki.ai/wiki/shape_tensor)**: Sizes along each tensor dimension.
- **[shrinkage](https://aiwiki.ai/wiki/shrinkage)**: Reducing boosting step contributions.
- **[sigmoid function](https://aiwiki.ai/wiki/sigmoid_function)**: Activation mapping reals to between zero and one.
- **[similarity measure](https://aiwiki.ai/wiki/similarity_measure)**: Function quantifying example likeness.
- **[size invariance](https://aiwiki.ai/wiki/size_invariance)**: Predictions unchanged under input rescaling.
- **[sketching](https://aiwiki.ai/wiki/sketching)**: Approximate summaries of large datasets.
- **[softmax](https://aiwiki.ai/wiki/softmax)**: Turning a vector into a probability distribution.
- **[sparse feature](https://aiwiki.ai/wiki/sparse_feature)**: Feature with mostly zero values.
- **[sparse representation](https://aiwiki.ai/wiki/sparse_representation)**: Representation with mostly zero entries.
- **[sparse vector](https://aiwiki.ai/wiki/sparse_vector)**: Vector storing only nonzero entries.
- **[sparsity](https://aiwiki.ai/wiki/sparsity)**: Proportion of zero entries.
- **[spatial pooling](https://aiwiki.ai/wiki/spatial_pooling)**: Pooling across spatial feature map dimensions.
- **[split](https://aiwiki.ai/wiki/split)**: Subset of data such as train or test.
- **[splitter](https://aiwiki.ai/wiki/splitter)**: Tree component selecting best node conditions.
- **[squared hinge loss](https://aiwiki.ai/wiki/squared_hinge_loss)**: Hinge loss with squared margin violation.
- **[squared loss](https://aiwiki.ai/wiki/squared_loss)**: Squared prediction-target difference.
- **[stability](https://aiwiki.ai/wiki/stability)**: Consistency under small changes.
- **[staged training](https://aiwiki.ai/wiki/staged_training)**: Training in increasing-complexity phases.
- **[state](https://aiwiki.ai/wiki/state)**: Description of RL environment at a moment.
- **[state-action value function](https://aiwiki.ai/wiki/state-action_value_function)**: Synonym for Q-function.
- **[static](https://aiwiki.ai/wiki/static)**: Trained once and not updated.
- **[static inference](https://aiwiki.ai/wiki/static_inference)**: Synonym for offline inference.
- **[stationarity](https://aiwiki.ai/wiki/stationarity)**: Data statistics unchanged over time.
- **[step](https://aiwiki.ai/wiki/step)**: One training iteration on one batch.
- **[step size](https://aiwiki.ai/wiki/step_size)**: Synonym for learning rate.
- **[stochastic gradient descent (SGD)](https://aiwiki.ai/wiki/stochastic_gradient_descent_sgd)**: Gradient descent on random examples or batches.
- **[stride](https://aiwiki.ai/wiki/stride)**: Convolutional filter step size.
- **[structural risk minimization (SRM)](https://aiwiki.ai/wiki/structural_risk_minimization_srm)**: Balancing training error and complexity.
- **[subsampling](https://aiwiki.ai/wiki/subsampling)**: Selecting a smaller data subset.
- **[summary](https://aiwiki.ai/wiki/summary)**: TensorFlow value recorded for [TensorBoard](https://aiwiki.ai/wiki/tensorboard).[1]
- **[supervised machine learning](https://aiwiki.ai/wiki/supervised_machine_learning)**: Learning from labeled input-output pairs.
- **[synthetic feature](https://aiwiki.ai/wiki/synthetic_feature)**: Feature derived from existing ones.

## T

- **[tabular Q-learning](https://aiwiki.ai/wiki/tabular_q-learning)**: Q-learning storing values in a table.
- **[target](https://aiwiki.ai/wiki/target)**: Synonym for label.
- **[target network](https://aiwiki.ai/wiki/target_network)**: Delayed Q-network copy for stability.
- **[temporal data](https://aiwiki.ai/wiki/temporal_data)**: Data indexed by time.
- **[Tensor](https://aiwiki.ai/wiki/tensor)**: Multidimensional array, the deep learning data structure.
- **TensorBoard**: TensorFlow visualization toolkit for training runs.[1]
- **[TensorFlow](https://aiwiki.ai/wiki/tensorflow)**: Open-source machine learning platform from Google.[1]
- **[TensorFlow Playground](https://aiwiki.ai/wiki/tensorflow_playground)**: Interactive browser tool for small networks.[1]
- **[TensorFlow Serving](https://aiwiki.ai/wiki/tensorflow_serving)**: Production serving system for TensorFlow models.[1]
- **[Tensor Processing Unit (TPU)](https://aiwiki.ai/wiki/tensor_processing_unit_tpu)**: Google's neural network hardware accelerator.[1]
- **[Tensor rank](https://aiwiki.ai/wiki/tensor_rank)**: Number of tensor dimensions.
- **[Tensor shape](https://aiwiki.ai/wiki/tensor_shape)**: Sizes along each tensor dimension.
- **[Tensor size](https://aiwiki.ai/wiki/tensor_size)**: Total number of tensor elements.
- **[termination condition](https://aiwiki.ai/wiki/termination_condition)**: Criterion ending an iterative process.
- **[test](https://aiwiki.ai/wiki/test)**: Tree condition or held-out evaluation set.
- **[test loss](https://aiwiki.ai/wiki/test_loss)**: Loss on the test set.
- **[test set](https://aiwiki.ai/wiki/test_set)**: Held-out data for final evaluation.
- **[tf.Example](https://aiwiki.ai/wiki/tf_example)**: TensorFlow protocol buffer for one example.[1]
- **[tf.keras](https://aiwiki.ai/wiki/tf_keras)**: TensorFlow bundled Keras API.[1]
- **[threshold (for decision trees)](https://aiwiki.ai/wiki/threshold_for_decision_trees)**: Cutoff value in a tree split.
- **[time series analysis](https://aiwiki.ai/wiki/time_series_analysis)**: Studying data sequenced in time.
- **[timestep](https://aiwiki.ai/wiki/timestep)**: One position in a sequence or RL tick.
- **[token](https://aiwiki.ai/wiki/token)**: Discrete unit such as a word or subword.
- **[tower](https://aiwiki.ai/wiki/tower)**: Model replica in distributed training.
- **[TPU](https://aiwiki.ai/wiki/tpu)**: Abbreviation for Tensor Processing Unit.[1]
- **[TPU chip](https://aiwiki.ai/wiki/tpu_chip)**: Single integrated circuit performing TPU computation.[1]
- **[TPU device](https://aiwiki.ai/wiki/tpu_device)**: Board with one or more TPU chips.[1]
- **[TPU master](https://aiwiki.ai/wiki/tpu_master)**: Coordinator dispatching to TPU workers.[1]
- **[TPU node](https://aiwiki.ai/wiki/tpu_node)**: Cloud TPU resource exposed to a VM.[1]
- **[TPU Pod](https://aiwiki.ai/wiki/tpu_pod)**: Cluster of many TPU chips on fast networking.[1]
- **[TPU resource](https://aiwiki.ai/wiki/tpu_resource)**: Allocation of TPU compute in [Google Cloud](https://aiwiki.ai/wiki/google_cloud).[1]
- **[TPU slice](https://aiwiki.ai/wiki/tpu_slice)**: Subset of TPU chips from a Pod.[1]
- **[TPU type](https://aiwiki.ai/wiki/tpu_type)**: TPU configuration label like v3 or v4.[1]
- **[TPU worker](https://aiwiki.ai/wiki/tpu_worker)**: Process running TPU computation.[1]
- **[training](https://aiwiki.ai/wiki/training)**: Fitting model parameters to data.
- **[training loss](https://aiwiki.ai/wiki/training_loss)**: Loss on training data.
- **[training-serving skew](https://aiwiki.ai/wiki/training-serving_skew)**: Gap between training and serving data processing.
- **[training set](https://aiwiki.ai/wiki/training_set)**: Data used to fit model parameters.
- **[trajectory](https://aiwiki.ai/wiki/trajectory)**: Sequence of RL states, actions, rewards.
- **[transfer learning](https://aiwiki.ai/wiki/transfer_learning)**: Reusing knowledge across related tasks.
- **[Transformer](https://aiwiki.ai/wiki/transformer)**: Self-attention-based architecture dominant in language modeling.
- **[translational invariance](https://aiwiki.ai/wiki/translational_invariance)**: Predictions unchanged under input shifts.
- **[trigram](https://aiwiki.ai/wiki/trigram)**: Sequence of three adjacent tokens.
- **[true negative (TN)](https://aiwiki.ai/wiki/true_negative_tn)**: Correct negative prediction.
- **[true positive (TP)](https://aiwiki.ai/wiki/true_positive_tp)**: Correct positive prediction.
- **[true positive rate (TPR)](https://aiwiki.ai/wiki/true_positive_rate_tpr)**: Synonym for recall.

## U

- **[unawareness (to a sensitive attribute)](https://aiwiki.ai/wiki/unawareness_to_a_sensitive_attribute)**: Fairness approach hiding sensitive attributes.
- **[underfitting](https://aiwiki.ai/wiki/underfitting)**: Model too simple to capture data patterns.
- **[undersampling](https://aiwiki.ai/wiki/undersampling)**: Reducing majority class examples.
- **[unidirectional](https://aiwiki.ai/wiki/unidirectional)**: Sequence processing in one direction only.
- **[unidirectional language model](https://aiwiki.ai/wiki/unidirectional_language_model)**: Language model conditioning only on past tokens.
- **[unlabeled example](https://aiwiki.ai/wiki/unlabeled_example)**: Example without a known label.
- **[unsupervised machine learning](https://aiwiki.ai/wiki/unsupervised_machine_learning)**: Learning structure without labels.
- **[uplift modeling](https://aiwiki.ai/wiki/uplift_modeling)**: Causal modeling of an action's incremental effect.
- **[upweighting](https://aiwiki.ai/wiki/upweighting)**: Increasing example influence in loss.
- **[user matrix](https://aiwiki.ai/wiki/user_matrix)**: Factor matrix for users in matrix factorization.

## V

- **[validation](https://aiwiki.ai/wiki/validation)**: Evaluating on a held-out set for tuning.
- **[validation loss](https://aiwiki.ai/wiki/validation_loss)**: Loss on the validation set.
- **[validation set](https://aiwiki.ai/wiki/validation_set)**: Data for model selection during development.
- **[vanishing gradient problem](https://aiwiki.ai/wiki/vanishing_gradient_problem)**: Gradients shrinking to zero in deep networks.
- **[variable importances](https://aiwiki.ai/wiki/variable_importances)**: Scores estimating feature influence.
- **[vector database](https://aiwiki.ai/wiki/vector_database)**: Storage for similarity search over embeddings.

## W

- **[Wasserstein loss](https://aiwiki.ai/wiki/wasserstein_loss)**: GAN loss based on earth mover's distance.
- **[weight](https://aiwiki.ai/wiki/weight)**: Learned parameter scaling an input or activation.
- **[Weighted Alternating Least Squares (WALS)](https://aiwiki.ai/wiki/weighted_alternating_least_squares_wals)**: Matrix factorization by alternating least squares.
- **[weighted sum](https://aiwiki.ai/wiki/weighted_sum)**: Linear combination of inputs and weights.
- **[wide model](https://aiwiki.ai/wiki/wide_model)**: Few-layer model with many features and feature crosses.
- **[width](https://aiwiki.ai/wiki/width)**: Number of units in a layer.
- **[wisdom of the crowd](https://aiwiki.ai/wiki/wisdom_of_the_crowd)**: Aggregated independent estimates often beat single ones.
- **[word embedding](https://aiwiki.ai/wiki/word_embedding)**: Dense vector representation of a word.

## Z

- **[zero-shot learning](https://aiwiki.ai/wiki/zero-shot_learning)**: Performing a task with no labeled examples.
- **[Z-score normalization](https://aiwiki.ai/wiki/z-score_normalization)**: Rescaling to zero mean and unit variance.

## References

[1] Google Developers: Machine Learning Glossary, https://developers.google.com/machine-learning/glossary
[2] Wikipedia: Glossary of artificial intelligence, https://en.wikipedia.org/wiki/Glossary_of_artificial_intelligence
[3] Wikipedia: Machine learning, https://en.wikipedia.org/wiki/Machine_learning
[4] Wikipedia: Deep learning, https://en.wikipedia.org/wiki/Deep_learning
[5] IBM: What is machine learning?, https://www.ibm.com/topics/machine-learning
[6] scikit-learn glossary, https://scikit-learn.org/stable/glossary.html
