Neural Information Processing Systems Foundation, Inc. (NeurIPS)

  • How do Large Language Models Handle Multilingualism?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How do Large Language Models Handle Multilingualism?

    Yiran Zhao, Wenxuan Zhang, Guizhen Chen, Kenji Kawaguchi, Lidong Bing p15296-15319 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How do Minimum-Norm Shallow Denoisers Look in Function Space?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How do Minimum-Norm Shallow Denoisers Look in Function Space?

    Chen Zeno, Greg Ongie, Yaniv Blumenfeld, Nir Weinberger, Daniel Soudry p57520-57557 from Advances in Neural Information Processing Systems 36
    Our Price: $0.00
  • How do Transformers Learn Implicit Reasoning?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How do Transformers Learn Implicit Reasoning?

    Jiaran Ye, Zijun Yao, Zhidian Huang, Liangming Pan, Jinxin Liu, Yushi Bai, Amy Xin, Liu Weichuan, Xiaoyin Che, Lei Hou, Juanzi Li p73341-73369 from Advances in Neural Information Processing Systems 38
    Our Price: $0.00
  • How Does Adaptive Optimization Impact Local Neural Network Geometry?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Does Adaptive Optimization Impact Local Neural Network Geometry?

    Kaiqi Jiang, Dhruv Malik, Yuanzhi Li p8305-8384 from Advances in Neural Information Processing Systems 36
    Our Price: $0.00
  • How does Architecture Influence the Base Capabilities of Pre-trained Language Models? A Case Study Based on FFN-Wider and MoE Transformers

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How does Architecture Influence the Base Capabilities of Pre-trained Language Models? A Case Study Based on FFN-Wider and MoE Transformers

    Xin Lu, Yanyan Zhao, Bing Qin, Liangyu Huo, Qing Yang, Dongliang Xu p87411-87437 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How Does Black-Box Impact the Learning Guarantee of Stochastic Compositional Optimization?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Does Black-Box Impact the Learning Guarantee of Stochastic Compositional Optimization?

    Jun Chen, Hong Chen, Bin Gu p107745-107794 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How does GPT-2 compute greater-than?: Interpreting mathematical abilities in a pre-trained language model

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How does GPT-2 compute greater-than?: Interpreting mathematical abilities in a pre-trained language model

    Michael Hanna, Ollie Liu, Alexandre Variengien p76033-76060 from Advances in Neural Information Processing Systems 36
    Our Price: $0.00
  • How does Gradient Descent Learn Features --- A Local Analysis for Regularized Two-Layer Neural Networks

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How does Gradient Descent Learn Features --- A Local Analysis for Regularized Two-Layer Neural Networks

    Mo Zhou, Rong Ge p46481-46538 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How does Inverse RL Scale to Large State Spaces? A Provably Efficient Approach

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How does Inverse RL Scale to Large State Spaces? A Provably Efficient Approach

    Filippo Lazzati, Mirco Mutti, Alberto Maria Metelli p54820-54871 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How Does Label Noise Gradient Descent Improve Generalization in the Low SNR Regime?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Does Label Noise Gradient Descent Improve Generalization in the Low SNR Regime?

    Wei Huang, Andi Han, Yujin Song, Yilan Chen, Denny Wu, Difan Zou, Taiji Suzuki p193690-193736 from Advances in Neural Information Processing Systems 38
    Our Price: $0.00
  • How Does Message Passing Improve Collaborative Filtering?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Does Message Passing Improve Collaborative Filtering?

    Clark Ju, William Shiao, Zhichun Guo, Yanfang Ye, Yozen Liu, Neil Shah, Tong Zhao p8760-8784 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How does PDE order affect the convergence of PINNs?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How does PDE order affect the convergence of PINNs?

    Changhoon Song, Yesom Park, Myungjoo Kang p73-131 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How Does Sequence Modeling Architecture Influence Base Capabilities of Pre-trained Language Models? Exploring Key Architecture Design Principles to Avoid Base Capabilities Degradation

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Does Sequence Modeling Architecture Influence Base Capabilities of Pre-trained Language Models? Exploring Key Architecture Design Principles to Avoid Base Capabilities Degradation

    Xin Lu, Yanyan Zhao, Si Wei, Shijin Wang, Bing Qin, Ting Liu p47758-47784 from Advances in Neural Information Processing Systems 38
    Our Price: $0.00
  • How Does Topology Bias Distort Message Passing in Graph Recommender? A Dirichlet Energy Perspective

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Does Topology Bias Distort Message Passing in Graph Recommender? A Dirichlet Energy Perspective

    Yanbiao Ji, Yue Ding, Dan Luo, Chang Liu, Yuxiang Lu, Xin Xin, Hongtao Lu p50764-50792 from Advances in Neural Information Processing Systems 38
    Our Price: $0.00
  • How Does Variance Shape the Regret in Contextual Bandits?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Does Variance Shape the Regret in Contextual Bandits?

    Zeyu Jia, Jian Qian, Alexander Rakhlin, Chen-Yu Wei p83730-83785 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How Ensembles of Distilled Policies Improve Generalisation in Reinforcement Learning

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Ensembles of Distilled Policies Improve Generalisation in Reinforcement Learning

    Max Weltevrede, Moritz Zanger, Matthijs Spaan, Wendelin Boehmer p150706-150746 from Advances in Neural Information Processing Systems 38
    Our Price: $0.00
  • How Far Are We from Optimal Reasoning Efficiency?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Far Are We from Optimal Reasoning Efficiency?

    Jiaxuan Gao, Shu Yan, Qixin Tan, lu Yang, Shusheng Xu, Wei Fu, Zhiyu Mei, Kaifeng Lyu, YI WU p12130-12160 from Advances in Neural Information Processing Systems 38
    Our Price: $0.00
  • How Far Can Camels Go? Exploring the State of Instruction Tuning on Open Resources

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Far Can Camels Go? Exploring the State of Instruction Tuning on Open Resources

    Yizhong Wang, Hamish Ivison, Pradeep Dasigi, Jack Hessel, Tushar Khot, Khyathi Chandu, David Wadden, Kelsey Macmillan, Noah Smith, Iz Beltagy, Hannaneh Hajishirzi p74764-74786 from Advances in Neural Information Processing Systems 36
    Our Price: $0.00
  • How Far Can Transformers Reason? The Globality Barrier and Inductive Scratchpad

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Far Can Transformers Reason? The Globality Barrier and Inductive Scratchpad

    Emmanuel Abbe, Samy Bengio, Aryo Lotfi, Colin Sandon, Omid Saremi p27850-27895 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How hard are computer vision datasets? Calibrating dataset difficulty to viewing time

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How hard are computer vision datasets? Calibrating dataset difficulty to viewing time

    David Mayo, Jesse Cummings, Xinyu Lin, Dan Gutfreund, Boris Katz, Andrei Barbu p11008-11036 from Advances in Neural Information Processing Systems 36
    Our Price: $0.00
  • How JEPA Avoids Noisy Features: The Implicit Bias of Deep Linear Self Distillation Networks

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How JEPA Avoids Noisy Features: The Implicit Bias of Deep Linear Self Distillation Networks

    Etai Littwin, Omid Saremi, Madhu Advani, Vimal Thilak, Preetum Nakkiran, Chen Huang, Joshua Susskind p91300-91336 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How many classifiers do we need?

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How many classifiers do we need?

    Hyunsuk Kim, Liam Hodgkinson, Ryan Theisen, Michael Mahoney p86458-86482 from Advances in Neural Information Processing Systems 37
    Our Price: $0.00
  • How Many Domains Suffice for Domain Generalization? A Tight Characterization via the Domain Shattering Dimension

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How Many Domains Suffice for Domain Generalization? A Tight Characterization via the Domain Shattering Dimension

    Cynthia Dwork, Lunjia Hu, Han Shao p127501-127527 from Advances in Neural Information Processing Systems 38
    Our Price: $0.00
  • How many measurements are enough? Bayesian recovery in inverse problems with general distributions

    Neural Information Processing Systems Foundation, Inc. (NeurIPS)

    How many measurements are enough? Bayesian recovery in inverse problems with general distributions

    Ben Adcock, Zi Yuan (Nick) Huang p107888-107929 from Advances in Neural Information Processing Systems 38
    Our Price: $0.00