AI 快讯列表

AI 快讯列表关于 混合专家

时间 详情
15:39
Kimi K3 发布权重与技术报告

据TheRundownAI称,Moonshot开源Kimi K3权重与技术资料,2.8T MoE、视觉与百万上下文。

2026-07-22
00:34
Laguna S 2.1发布:118B强势来袭

据soumithchintala称,Laguna S 2.1具118B MoE与百万上下文,单机DGX Spark可运行,权重已在Hugging Face开放。

2026-07-07
04:14
腾讯Hy3免费登陆OpenRouter

据@openclaw称,腾讯Hy3在OpenRouter限免至7月21日,295B MoE与256K上下文,适配编码与智能体。

2026-04-02
16:08
Gemma 4重磅发布:31B稠密、26B MoE、4B与2B开源模型——性能与低延迟的2026实战指南

据@demishassabis在Twitter上发布的信息,Google DeepMind推出Gemma 4开源模型家族,涵盖31B稠密模型(面向高原始性能)、26B MoE(面向低延迟交互),以及适合边缘设备的4B与2B模型,并支持针对特定任务微调。据原始来源披露,该布局面向企业与端侧部署,带来更低推理成本、更高吞吐与更强隐私性;其中26B MoE适合高并发对话与代理应用,2B与4B适合移动与物联网场景的本地RAG、轻量助理与内容安全过滤,31B稠密则适用于对质量敏感的总结与代码生成等任务。

2026-01-03
12:47
AI模型架构新趋势:自适应专家数量、跨模型专家共享与MoE商业应用前景

根据God of Prompt的最新推文,混合专家(MoE)架构正引领AI模型创新,下一个发展方向包括:自适应专家数量(训练过程中动态调整专家数量)、跨模型专家共享(在不同模型间复用专家组件提升效率)、分层MoE(专家可将任务分配给子专家,实现更细粒度的专业化)、以及专家蒸馏(将MoE知识压缩为密集模型,便于边缘部署)。这些技术有望提升AI模型的可扩展性与资源利用率,为云端和边缘AI应用带来新的商业机会。(来源:@godofprompt,Twitter,2026年1月3日)