Real-Time Edge AI and Sensing Group
Popular repositories Loading
-
SmartThinker
SmartThinker PublicRepository for the paper “SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning”
Python 16
-
TokenFlow
TokenFlow PublicForked from sgl-project/sglang
[EuroSys 2026] TokenFlow: Buffer-aware preemptive scheduling and proactive KV-cache management for responsive LLM streaming.
Python 1
-
vattention
vattention PublicForked from microsoft/vattention
Dynamic Memory Management for Serving LLMs without PagedAttention
C
Repositories
- TokenFlow Public Forked from sgl-project/sglang
[EuroSys 2026] TokenFlow: Buffer-aware preemptive scheduling and proactive KV-cache management for responsive LLM streaming.
- SmartThinker Public
Repository for the paper “SmartThinker: Progressive Chain-of-Thought Length Calibration for Efficient Large Language Model Reasoning”
- vattention Public Forked from microsoft/vattention
Dynamic Memory Management for Serving LLMs without PagedAttention
- SemiCMT Public
SemiCMT: Contrastive Cross-Modal Knowledge Transfer for IoT Sensing with Semi-Paired Multi-Modal Signals
People
This organization has no public members. You must be a member to see who’s a part of this organization.
Top languages
Loading…
Most used topics
Loading…