More from Avi Chawla | AI News
AI News
Avi Chawla
@_avichawlaDaily tutorials and insights on DS, ML, LLMs, and RAGs • Co-founder
|
LMCache以CacheBlend实现14倍加速
据@_avichawla称,LMCache多进程与CacheBlend使TTFT快14倍、解码快4倍,成本降至一成。 (Source) 07-17-2026 09:51 |
|
GPU传输加速4倍用int8先传技巧
据@_avichawla称,先传int8再在GPU转换可提速4倍;二值量化使RAG向量缩至1/32并加速检索。 (Source) 06-22-2026 12:58 |
|
CMU研究揭示Cursor短期增产长期风险
据@_avichawla称:807仓库匹配对比,首月产出升3-5倍,但告警增30%、复杂度增41%且持续。 (Source) 06-18-2026 08:25 |
|
Flash KMeans实现200倍提速突破
据X用户@_avichawla称,Flash KMeans消除GPU内存瓶颈,较cuML快33倍、较FAISS快200倍。 (Source) 06-16-2026 08:42 |