新Qwen 3.8 27B 表现出色,但默认推理强度过高导致过度思考阿里 Qwen 实验室发布 Apache 2 许可的 27B 参数视觉大模型 Qwen 3.8 27B,官方基准显示其超越前代 Qwen 3.6 27B 及闭源 Qwen 3.7-Plus。AI资讯分类技术资讯# 推理# 端侧# 编码11小时前02360
新WhatsApp 如何用端到端加密与可验证性构建 Scam Alert 诈骗提醒功能WhatsApp 推出可选功能 Scam Alert,通过端到端加密保护下在设备端运行机器学习模型,识别潜在诈骗消息,且消息内容不会离开设备或自动上报。该功能遵循仅设备端处理、无自动上报、用户控制三大...AI资讯分类技术资讯# Meta# 产品更新# 安全/对齐4天前0840
新NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务...AI资讯分类技术资讯# 推理# 模型发布# 端侧5天前01140
新Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。AI资讯分类技术资讯# 开源生态# 推理# 智能体5天前01260
新SGLang 为 Muse Glimmer 提供 Day-0 支持,针对本地智能体工作流优化推理SGLang 与 Meta Superintelligence Labs 合作,为 30B 参数多模态模型 Muse Glimmer 提供 Day-0 支持,该模型拥有 128k+ token 上下文...AI资讯分类技术资讯# Meta# 多模态# 智能体6天前01420
新Meta 发布开源模型 Muse Glimmer推出 Muse Glimmer,一款开放权重、300 亿参数的模型,专为本地、常驻运行的智能体工作流优化。 与同尺寸领先模型相比,Muse Glimmer 在关键智能体用例和基准测试中表现出色,并设计...AI资讯分类技术资讯# Meta# 智能体# 模型发布6天前01500
Swiftlet:在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需从存储...AI资讯分类技术资讯# 产品更新# 开源/仓库# 推理2周前0610
Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需 SSH 或云服务。AI资讯分类技术资讯# 产品更新# 开源生态# 数据/训练2周前010
在单颗 AMD MI300X 上运行 DeepSeek V4 Flash一个开源仓库提供了在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁,无需额外量化或权重卸载。该 304B 参数模型在 192 GB HBM 上实...AI资讯分类技术资讯# DeepSeek# 开源/仓库# 端侧2周前01120
MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。Python 包 PipeNetwork/minimax-h3-ml...AI资讯分类技术资讯# 教程/实践# 端侧# 视频2周前010