| Benchmarking Large Language Models with Integer Sequence Generation Tasks | Nov 7, 2024 | BenchmarkingComputational Efficiency | —Unverified | 0 | 0 |
| Benchmarking Large Language Model Volatility | Nov 26, 2023 | BenchmarkingDecision Making | —Unverified | 0 | 0 |
| Benchmarking LLM for Code Smells Detection: OpenAI GPT-4.0 vs DeepSeek-V3 | Apr 22, 2025 | BenchmarkingLanguage Modeling | —Unverified | 0 | 0 |
| Benchmarking Practices in LLM-driven Offensive Security: Testbeds, Metrics, and Experiment Design | Apr 14, 2025 | BenchmarkingLanguage Modeling | —Unverified | 0 | 0 |
| bert2BERT: Towards Reusable Pretrained Language Models | Oct 14, 2021 | Language ModelingLanguage Modelling | —Unverified | 0 | 0 |
| BeSimulator: A Large Language Model Powered Text-based Behavior Simulator | Sep 24, 2024 | Language ModelingLanguage Modelling | —Unverified | 0 | 0 |
| Better Process Supervision with Bi-directional Rewarding Signals | Mar 6, 2025 | Language ModelingLanguage Modelling | —Unverified | 0 | 0 |
| Better Think with Tables: Leveraging Tables to Enhance Large Language Model Comprehension | Dec 22, 2024 | Language ModelingLanguage Modelling | —Unverified | 0 | 0 |
| BEV-TSR: Text-Scene Retrieval in BEV Space for Autonomous Driving | Jan 2, 2024 | Autonomous DrivingCaption Generation | —Unverified | 0 | 0 |
| Beyond Bare Queries: Open-Vocabulary Object Grounding with 3D Scene Graph | Jun 11, 2024 | 3D Object Retrieval3D Semantic Segmentation | —Unverified | 0 | 0 |