ExecRetrieval: Measuring the Functional-Correctness Gap in Code-Embedding Retrieval
cs.SE, cs.AI, cs.CL, cs.IR
Submitted: 2026-09-01
Updated: 2026-09-01
Terminology
Sources
- Program Synthesis with Large Language Models
- Evaluating Large Language Models Trained on Code
- CodeSearchNet Challenge: Evaluating the State of Semantic Code Search
- Gemini Embedding: Generalizable Embeddings from Gemini
- Towards General Text Embeddings with Multi-stage Contrastive Learning
- Functional Consistency of LLM Code Embeddings: A Self-Evolving Data Synthesis Framework for Benchmarking
- Text and Code Embeddings by Contrastive Pre-Training
- Text Embeddings by Weakly-Supervised Contrastive Pre-training
- Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
Related papers
- Falsification-Based Verification of LLM-Generated Optimization Models: Sound Test Batteries and Their Detection Limits
- GitSkills: A Dataset of Agent Skills on GitHub
- SABER: Benchmarking Operational Safety of LLM Coding Agents in Stateful Project Workspaces
- PackMonitor: Enabling Zero Package Hallucinations Through Decoding-Time Monitoring
- IntentCoding: Amplifying User Intent in Code Generation
- Incentives and Outcomes in Bug Bounties