Stars
The official repo for “Dolphin: Document Image Parsing via Heterogeneous Anchor Prompting”, ACL, 2025.
✨✨[NeurIPS 2025] VITA-Audio: Fast Interleaved Cross-Modal Token Generation for Efficient Large Speech-Language Model
[EMNLP2025] "LightRAG: Simple and Fast Retrieval-Augmented Generation"
[CVPR 2025] EchoMimicV2: Towards Striking, Simplified, and Semi-Body Human Animation
[NeurIPS 2025] OmniTalker: Real-Time Text-Driven Talking Head Generation with In-Context Audio-Visual Style Replication
代理 MidJourney 的discord频道,实现api形式调用AI绘图
Code and models for "Learning to Compare Image Patches via Convolutional Neural Networks"
🔥正在成为史上最全分类 Android 开源大全~~~~(长期更新 Star 一下吧)
Generic framework for historical document processing
A tensorflow implementation of EAST text detector