Episodes (Page 13)
✨
UniOcc is a new benchmark for 3D occupancy prediction in autonomous driving.
✨
A new method generates counterfactual explanations for graph-based predictions.
✨
Research addresses continual forgetting in pre-trained vision models.
✨
Optimizing adaptive OFDM for autonomous vehicles using millimeter wave.
✨
Improving video generation by aligning with human preferences.
✨
AnimeGamer enables infinite anime life simulation games.
✨
NoProp trains neural networks without backpropagation or forward/backward passes.
✨
ACPBench Hard evaluates LLM reasoning for automated planning.
✨
Episode: Efficient Training of Large Language Models
✨
Introduces Uni4D for dynamic 4D modeling from casual videos.
✨
Presents KDTalker for audio-driven talking portraits.
✨
Announces OLMo 2, fully open 7B and 13B language models.
✨
Introduces Stable-SCore for stable 3D shape correspondence.
✨
Presents ProjectEval for benchmarking LLM code generation agents.
✨
Framework for embodied AI agent confidence in dynamic environments.
✨
VLMs playing StarCraft II with multimodal decision benchmark.
✨
M-Attack: effective attacks against strong vision-language models.
✨
Deep learning for inverse design of RF circuits.
✨
Simon Willison's guide on coding with LLMs for developers
✨
Vision-R1 extends reasoning capabilities to multimodal models with visual inputs