METELLI, ALBERTO MARIA
 Distribuzione geografica
Continente #
NA - Nord America 4.253
AS - Asia 3.877
EU - Europa 3.533
SA - Sud America 666
Continente sconosciuto - Info sul continente non disponibili 165
AF - Africa 127
OC - Oceania 17
Totale 12.638
Nazione #
US - Stati Uniti d'America 4.073
RU - Federazione Russa 1.497
SG - Singapore 1.345
IT - Italia 1.055
CN - Cina 1.011
BR - Brasile 548
VN - Vietnam 532
KR - Corea 276
JP - Giappone 235
FR - Francia 184
DE - Germania 173
HK - Hong Kong 137
GB - Regno Unito 115
CA - Canada 104
NL - Olanda 99
FI - Finlandia 92
SE - Svezia 65
ID - Indonesia 63
IN - India 63
ES - Italia 61
BD - Bangladesh 51
IE - Irlanda 51
MA - Marocco 51
AR - Argentina 50
AT - Austria 30
IQ - Iraq 30
PL - Polonia 27
MX - Messico 24
CI - Costa d'Avorio 23
TW - Taiwan 20
CH - Svizzera 17
EC - Ecuador 16
AU - Australia 15
JM - Giamaica 14
JO - Giordania 14
UA - Ucraina 14
PK - Pakistan 12
PY - Paraguay 12
ZA - Sudafrica 11
CO - Colombia 10
TR - Turchia 10
UZ - Uzbekistan 10
VE - Venezuela 10
CZ - Repubblica Ceca 9
CL - Cile 8
KE - Kenya 8
AE - Emirati Arabi Uniti 7
BJ - Benin 7
DZ - Algeria 7
KZ - Kazakistan 7
NP - Nepal 7
PH - Filippine 7
SA - Arabia Saudita 7
GR - Grecia 6
IR - Iran 6
PE - Perù 6
TH - Thailandia 6
BE - Belgio 5
CR - Costa Rica 5
DO - Repubblica Dominicana 5
HN - Honduras 5
LT - Lituania 5
NI - Nicaragua 5
EG - Egitto 4
ET - Etiopia 4
LV - Lettonia 4
PT - Portogallo 4
RO - Romania 4
TT - Trinidad e Tobago 4
UY - Uruguay 4
AZ - Azerbaigian 3
KG - Kirghizistan 3
KW - Kuwait 3
MY - Malesia 3
PA - Panama 3
PR - Porto Rico 3
SV - El Salvador 3
TN - Tunisia 3
AL - Albania 2
AO - Angola 2
BO - Bolivia 2
EU - Europa 2
HU - Ungheria 2
IL - Israele 2
LB - Libano 2
MD - Moldavia 2
NO - Norvegia 2
SI - Slovenia 2
AW - Aruba 1
BB - Barbados 1
BS - Bahamas 1
BY - Bielorussia 1
CG - Congo 1
CM - Camerun 1
EE - Estonia 1
GE - Georgia 1
GP - Guadalupe 1
GT - Guatemala 1
HR - Croazia 1
IS - Islanda 1
Totale 12.462
Città #
Ashburn 792
Singapore 732
San Jose 523
Milan 471
Hefei 291
Seoul 259
Santa Clara 233
Tokyo 202
Chandler 180
Moscow 180
Council Bluffs 177
Beijing 153
Boardman 142
Ho Chi Minh City 134
Hanoi 129
Dallas 127
Los Angeles 124
Hong Kong 107
The Dalles 87
Lauterbourg 85
North Charleston 68
New York 67
Rome 64
Frankfurt am Main 63
Kent 62
Fairfield 61
Helsinki 52
São Paulo 52
Amsterdam 50
London 49
Dublin 47
Jakarta 44
Buffalo 42
Da Nang 42
Las Vegas 35
Stockholm 35
Chicago 34
Seattle 34
Redmond 31
Kenitra 29
Redwood City 28
Haiphong 27
Málaga 27
Atlanta 25
Orem 25
Wilmington 24
Brooklyn 23
Düsseldorf 23
Lappeenranta 23
Lawrence 23
Abidjan 22
Montreal 22
Shanghai 22
Ottawa 21
Redondo Beach 21
Houston 20
Warsaw 20
Frisco 17
Guangzhou 17
Turin 17
Phoenix 16
Rio de Janeiro 16
Tianjin 16
Toronto 16
Vienna 16
Woodbridge 16
Cambridge 15
Medford 15
Amman 14
Munich 14
Taipei 14
Biên Hòa 13
Boston 13
Casablanca 13
Dong Ket 13
Monza 13
Naples 13
Nuremberg 13
Turku 13
Changsha 12
Curitiba 12
Pincourt 12
Ann Arbor 11
Borgomanero 11
Brasília 11
Campinas 11
Denver 11
Belo Horizonte 10
Columbus 10
Florence 10
Newark 10
Zurich 10
Baghdad 9
Bologna 9
Brescia 9
Chennai 9
Kingston 9
Mexico City 9
Miami 9
Pittsburgh 9
Totale 7.021
Nome #
Wasserstein Actor-Critic: Directed Exploration via Optimism for Continuous-Actions Control 306
Stochastic Rising Bandits 299
An Option-Dependent Analysis of Regret Minimization Algorithms in Finite-Horizon Semi-MDP 251
On the use of the policy gradient and Hessian in inverse reinforcement learning 240
Optimistic Policy Optimization via Multiple Importance Sampling 210
Feature Selection via Mutual Information: New Theoretical Insights 208
Combining reinforcement learning with rule-based controllers for transparent and general decision-making in autonomous driving 203
Dealing with multiple experts and non-stationarity in inverse reinforcement learning: an application to real-life problems 203
A Provably Efficient Option-Based Algorithm for both High-Level and Low-Level Learning 192
Convergence Analysis of Policy Gradient Methods with Dynamic Stochasticity 188
Propagating Uncertainty in Reinforcement Learning via Wasserstein Barycenters 185
Configurable Markov Decision Processes 183
Gradient-Aware Model-Based Policy Search 179
Best Arm Identification for Stochastic Rising Bandits 177
ARLO: A framework for Automated Reinforcement Learning 174
Switching Latent Bandits 174
Balancing Sample Efficiency and Suboptimality in Inverse Reinforcement Learning 171
Autoregressive Bandits 167
Factored-Reward Bandits with Intermediate Observations 164
Control Frequency Adaptation via Action Persistence in Batch Reinforcement Learning 162
IWDA: Importance Weighting for Drift Adaptation in Streaming Supervised Learning Problems 159
Dynamical Linear Bandits 157
Advancing drought monitoring via feature extraction 157
Optimizing Empty Container Repositioning and Fleet Deployment via Configurable Semi-POMDPs 156
Simultaneously Updating All Persistence Values in Reinforcement Learning 156
Advancing drought monitoring via feature extraction and multi-task learning algorithms 156
Importance Sampling Techniques for Policy Optimization 156
Interpretable Machine Learning for Extreme Events detection: An application to droughts in the Po River Basin 154
Switching Latent Bandits 153
A Tale of Sampling and Estimation in Discounted Reinforcement Learning 151
Trust Region Meta Learning for Policy Optimization 151
Graph-Triggered Rising Bandits 151
Truly Batch Model-Free Inverse Reinforcement Learning about Multiple Intentions 149
A Provably Efficient Option-Based Algorithm for both High-Level and Low-Level Learning 148
Content-based approaches for cold-start job recommendations 148
Truncating Trajectories in Monte Carlo Reinforcement Learning 146
Provably Efficient Learning of Transferable Rewards 146
Sleeping Reinforcement Learning 145
Towards Theoretical Understanding of Inverse Reinforcement Learning 142
Last-Iterate Global Convergence of Policy Gradients for Constrained Reinforcement Learning 141
Compatible Reward Inverse Reinforcement Learning 141
A unified view of configurable Markov Decision Processes: Solution concepts, value functions, and operators 140
Sample complexity of variance-reduced policy gradient: weaker assumptions and lower bounds 138
State and Action Factorization in Power Grids 138
Local Linearity: the Key for No-regret Reinforcement Learning in Continuous MDPs 137
Causal feature selection via transfer entropy 137
Tight Performance Guarantees of Imitator Policies with Continuous Actions 137
Policy optimization via importance sampling 136
Configurable Environments in Reinforcement Learning: An Overview 135
Policy Optimization as Online Learning with Mediator Feedback 133
Learning Optimal Deterministic Policies with Stochastic Policy Gradients 132
(ϵ, u)-Adaptive Regret Minimization in Heavy-Tailed Bandits 131
Transfer Learning for Dynamical Systems Models via Autoencoders and GANs 130
Lifelong Hyper-Policy Optimization with Multiple Importance Sampling Regularization 127
Dissimilarity Bandits 125
Exploiting environment configurability in reinforcement learning 125
Online Learning with Off-Policy Feedback in Adversarial MDPs 121
No-Regret Reinforcement Learning in Smooth MDPs 120
Interpretable linear dimensionality reduction based on bias-variance analysis 117
Truncating Trajectories in Monte Carlo Policy Evaluation: an Adaptive Approach 115
On the Relation between Policy Improvement and Off-Policy Minimum-Variance Policy Evaluation 115
Projection by Convolution: Optimal Sample Complexity for Reinforcement Learning in Continuous-Space MDPs 115
Multi-Fidelity Best-Arm Identification 114
Safe policy iteration: A monotonically improving approximate policy iteration approach 112
Storehouse: a Reinforcement Learning Environment for Optimizing Warehouse Management 109
Interpretable Target-Feature Aggregation for Multi-task Learning Based on Bias-Variance Analysis 108
Factored-Reward Bandits with Intermediate Observations: Regret Minimization and Best Arm Identification 108
Reinforcement Learning in Configurable Continuous Environments 108
Distributional Policy Evaluation: a Maximum Entropy approach to Representation Learning 107
Policy space identification in configurable environments 107
Information-Theoretic Regret Bounds for Bandits with Fixed Expert Advice 106
Parameterized Projected Bellman Operator 106
Position: Constants are Critical in Regret Bounds for Reinforcement Learning 105
Offline Inverse RL: New Solution Concepts and Provably Efficient Algorithms 105
Learning in Non-Cooperative Configurable Markov Decision Processes 103
Sub-optimal Experts mitigate Ambiguity in Inverse Reinforcement Learning 101
Towards Theoretical Understanding of Sequential Decision Making with Preference Feedback 99
How does Inverse RL Scale to Large State Spaces? A Provably Efficient Approach 98
Achieving \mathcal{O}(\sqrt{T}) Regret in Average-Reward POMDPs with Known Observation Models 97
The Power of Hybrid Learning in Industrial Robotics: Efficient Grasping Strategies with Supervised-Driven Reinforcement Learning 95
Subgaussian and Differentiable Importance Sampling for Off-Policy Evaluation and Learning 93
Optimal multi-fidelity best-arm identification 91
Learning Utilities from Demonstrations in Markov Decision Processes 75
Search or split: policy gradient with adaptive policy space 70
Power Grid Control with Graph-Based Distributed Reinforcement Learning 60
Trading-off Reward Maximization and Stability in Sequential Decision Making 51
Policy Gradient Methods with Adaptive Policy Spaces 51
Recent Advancements in Inverse Reinforcement Learning 41
Human-AI interaction in safety-critical network infrastructures 36
Tightening Regret Lower and Upper Bounds in Restless Rising Bandits 32
Efficient Exploitation of Hierarchical Structure in Sparse Reward Reinforcement Learning 32
Generalizing the Regret: an Analysis of Lower and Upper Bounds 27
Achieving Orp?Tq Regret in Average-Reward POMDPs with Known Observation Models 24
Catoni-Style Change Point Detection for Regret Minimization in Piecewise-Stationary Heavy-Tailed Bandits 23
Robustness in the Face of Partial Identifiability in Reward Learning 22
Minimax off-policy evaluation and learning with subgaussian and differentiable importance weighting 20
Information Capacity Regret Bounds for Bandits with Mediator Feedback 18
AReS: A patient simulator to facilitate testing of automated anesthesia 18
Online Compatible Reward Identification from Preference Feedback 16
Reusing Trajectories in Policy Gradients Enables Fast Convergence 15
Totale 12.606
Categoria #
all - tutte 34.116
article - articoli 8.055
book - libri 446
conference - conferenze 25.113
curatela - curatele 0
other - altro 0
patent - brevetti 0
selected - selezionate 0
volume - volumi 502
Totale 68.232


Totale Lug Ago Sett Ott Nov Dic Gen Feb Mar Apr Mag Giu
2021/2022198 0 27 15 14 17 7 23 12 18 16 20 29
2022/2023424 37 46 19 55 40 35 2 32 58 49 38 13
2023/2024533 49 71 73 32 20 64 21 43 6 52 8 94
2024/20252.140 26 33 43 57 262 145 72 142 271 181 442 466
2025/20268.386 1.327 1.291 624 732 440 389 1.106 385 596 705 210 581
2026/2027503 338 165 0 0 0 0 0 0 0 0 0 0
Totale 12.638