Qwen

10 篇报道

Qwen 是阿里巴巴推出的开放权重模型家族,用于语言、语音和视觉任务。近期报道关注 Qwen3.8-27B 在 Cerebras 上高速推理、Nari Labs 开源的 Qwen3-TTS/ASR 引擎(宣称在 10 RPS 下延迟 <50 ms)、发布了 Qwen-Drive-1.0(9B、Bf16)、以及基于 Qwen 的 Iris-mini/Iris-pro 搜索代理和社区关于 GGUF 模型列表的讨论。

相关话题

社区讨论稠密9B模型兴趣

一位Reddit用户表示已准备好约9.4B参数的稠密模型并计划开源代码与数据,称可在单张GPU上训练并采用Llama 3分词器与多种工程技术,征询社区对用途与寄托算力的兴趣。

r/LocalLLaMA · · 详情

Qwen 发布 Qwen-Drive-1.0 驱动方向模型

Qwen 发布了为自动驾驶微调的 Qwen-Drive-1.0,保留预训练视觉-语言架构并集成3D感知、视觉问答和运动规划。该模型的全 Bf16 检查点为 9B,并在 Hugging Face 仓库中链接到一篇约40页的技术报告。

r/LocalLLaMA · · 详情
已经到底了