-
DeepSeek V4.1 Flash正式发布:原生支持多模态,API 成本进一步降低
DeepSeek 正式发布 V4.1 Flash 模型,采用全新的非对称 Causal-Encoder-Decoder 架构,总参数量为 552B,输入激活 8B、输出激活 16B。新模型原生支持视觉理解,并通过压缩 KV Cache、优化推理效率和下调 API 价格,进一步降低 AI Agent、编程及长上下文任务的使用成本。- 1.7k
- 0
-
DeepSeek V4.1 Flash - DeepSeek开源的原生多模态 MoE 模型
DeepSeek-V4.1-Flash 是深度求索开源的原生多模态 MoE 模型,552B 主干参数、非对称 CED 架构,支持 1M 上下文与图片理解,面向 Agent 与编程任务,API 模型名 deepseek-flash,在AIHub了解更多。- 271
- 0
-
DeepSeek-V4-Flash-Vision-Exp开放模型权重,采用MIT协议开源
DeepSeek正式开放DeepSeek-V4-Flash-Vision-Exp模型权重及参考推理代码,采用MIT协议,支持多模态Agent研究、私有化部署与二次开发。- 1.2k
- 0
-
腾讯发布并开源 Hy4 preview:770B参数、1M上下文,强化编程与科研能力
腾讯混元发布并开源新一代旗舰模型 Hy4 preview,采用770B总参数、49B激活参数的MoE架构,支持1M Tokens上下文,重点提升软件工程、办公分析、游戏开发与科学研究能力,现已上线腾讯云和OpenRouter。- 946
- 0
-
Hy4 preview - 腾讯混元发布的新一代开源旗舰大语言模型
Hy4 preview 是腾讯混元推出的770B参数MoE旗舰模型,激活49B参数,支持1M上下文,重点强化编程、办公分析、游戏开发与科学研究能力。- 2.1k
- 0
-
Qwen3.8-Flash:阿里通义千问最新推出的多模态大模型
Qwen3.8-Flash-Next 是阿里通义千问推出的开放权重多模态 MoE 模型,预览 Qwen4 架构,支持编程、办公智能体、图像视频理解及百万级上下文。- 795
- 0
-
智谱发布 GLM-5.3-Flash:GLM-5 系列首款原生多模态模型
2026年08月26日,智谱 AI 正式发布 GLM-5.3-Flash,也就是此前受到行业关注的“ox-alpha”。这是 GLM-5 系列首款原生多模态模型,面向 Coding、Agent 和专业生产力任务,在保持较强模型能力的同时,进一步降低推理与使用成本。 GLM-5.3-Flash 采用 320B 总参数、18B 激活参数的 MoE 架构,并在 GLM 系列中首次结合稀疏注意力与线性注意…- 2.5k
- 0
-
GLM-5.3-Flash - 智谱推出的高性价比原生多模态模型
GLM-5.3-Flash 是智谱 AI 推出的 GLM-5 系列首款原生多模态模型,拥有 320B 总参数和 18B 激活参数,支持 100 万 token 上下文。模型聚焦编程、智能体与专业办公任务,通过混合注意力架构降低推理成本,并以 MIT 协议开放模型权重。- 701
- 0
-
Qwen3.8 正式开源:27B 原生多模态模型开放,消费级显卡可部署
阿里正式开源 Qwen3.8 系列,Qwen3.8-27B 采用 270 亿参数原生多模态 Dense 架构,综合能力超过 Qwen3.7-Plus,支持编程、办公和视觉理解,采用 Apache 2.0 协议,量化后可在消费级显卡部署。- 4.9k
- 0
-
GLM-5.3:智谱推出的开源AI编程与网络安全大模型
GLM-5.3 是智谱推出的新一代开源大模型,基于 GLM-5.2 相同基座通过大规模后训练提升 AI 编程、长程 Agent、终端操作、代码审查和漏洞发现能力,并计划在安全加固后开放完整模型权重。- 1.4k
- 0
-
Meta 发布开源模型 Muse Glimmer:30B 参数,Apache 2.0 协议,单张消费级显卡可运行
2026 年 8 月 10 日,Meta Superintelligence Labs 发布开放权重多模态模型 Muse Glimmer,这是该实验室成立以来首个公开权重的模型,也是 Meta 首次采用 OSI 认可的 Apache 2.0 协议发布模型,此前 Llama 系列使用的是带月活规模门槛的自定义社区许可。模型从旗舰闭源模型 Muse Spark 蒸馏而来,定位于常驻本地运行的智能体工作…- 1.8k
- 0
-
Muse Glimmer - Meta 开源的 30B 本地智能体模型,单卡即可常驻运行
Muse Glimmer是Meta开源的30B多模态智能体模型,Apache 2.0协议,支持131K上下文与函数调用,24GB显存单卡可本地运行。- 911
- 0
-
阿里发布 Qwen3.8-Max:2.4T 参数旗舰模型,Max 级别首次开源权重
2026年8月3日,阿里巴巴 Qwen 团队今日正式发布 Qwen3.8-Max,这是 Qwen 家族目前规模最大的基础模型。与历代 Max 级模型仅通过 API 提供服务不同,官方明确表示这一级别的权重将首次开源,预计下周在 Hugging Face 与 ModelScope 上线。模型现已通过千问AI平台开放调用,模型 ID 为 qwen3.8-max。 技术规格上,Qwen3.8-Max 基…- 4.2k
- 0
-
月之暗面发布Kimi K3:2.8万亿参数,支持百万Token上下文
月之暗面正式发布Kimi K3,模型总参数达到2.8万亿,支持100万Token上下文、原生图像与视频理解,重点强化长程编程、复杂智能体、科研分析和知识工作能力,并计划开放完整模型权重。- 8.1k
- 0
-
Kimi K3 - 月之暗面推出的2.8万亿参数开放权重多模态模型
Kimi K3是月之暗面推出的2.8万亿参数多模态旗舰模型,支持100万Token上下文、图像与视频理解、长程编程、AI智能体、知识工作及深度推理,可通过Kimi、Kimi Work、Kimi Code和API使用。- 4.6k
- 0
-
智谱 GLM-5.2 上线并开源,面向 Coding 与长程任务优化
2026年6月17日,智谱AI正式上线并开源新一代旗舰模型 GLM-5.2。该模型延续 GLM 系列在 Coding、Agent 和复杂工程任务方向的技术路线,重点提升长上下文处理、长程任务执行和项目级代码理解能力。 根据官方介绍,GLM-5.2 面向“长程任务”进行优化,支持 1M 上下文窗口 和 128K 最大输出 Tokens,可用于大型代码仓库理解、复杂系统重构、多步骤调试、移动端开发、多…- 8.8k
- 0
-
Khala - 中央音乐学院等开源的AI歌曲生成模型
Khala 是一个面向高保真歌曲生成的开源系统,支持基于文本描述与歌词条件生成完整歌曲。与依赖语义 token、扩散模型或多级音频生成模块的路线不同,Khala 采用统一的声学词元建模路线,在同一套离散音频表示空间中完成从粗粒度音乐结构到细粒度声学细节的生成。- 1.6k
- 0
-
阶跃星辰发布 Step 3.7 Flash:面向真实 Agent 场景的高效率多模态模型
2026年5月29日,阶跃星辰正式发布 Step 3.7 Flash,这是一款面向真实世界 Agent 场景的新一代高效率 Flash 模型。与传统偏问答的模型不同,Step 3.7 Flash 更强调“理解之后执行”,围绕多模态感知、网页与视觉搜索、工具调用、代码执行和 Agent 工作流进行了系统增强。 Step 3.7 Flash 采用稀疏 MoE 视觉语言模型架构,具备文本、图像、代码、搜…- 1.8k
- 0
-
Step 3.7 Flash - 阶跃星辰推出的面向真实 Agent 场景的高效率多模态模型
Step 3.7 Flash 是阶跃星辰推出的高效率 Flash 多模态模型,面向真实世界 Agent、智能编程、视觉搜索、工具调用和企业任务场景,支持 256k 上下文、原生图像理解、可靠工具编排和主流 Agent 生态兼容。- 2.6k
- 0
-
LongCat-Video-Avatar 1.5:美团开源的音频驱动数字人视频生成模型
LongCat-Video-Avatar 1.5 是美团 LongCat Team 开源的音频驱动数字人视频生成模型,基于 LongCat-Video 构建,支持单人、多人与多音频输入,可生成唇形同步、动作自然、身份稳定的虚拟人视频,适用于直播、讲解、表演、电商营销和动画角色等场景。- 2k
- 0
-
Lance - 字节跳动开源的原生统一多模态模型,支持图像与视频理解生成编辑
Lance 是字节跳动开源的 3B 原生统一多模态模型,支持图像生成、视频生成、图像编辑、视频编辑、图像理解和视频理解等任务,适合多模态研究、视觉生成实验和开发者二次开发。- 4.2k
- 0
-
MiMo-V2.5-Pro - 小米开源的旗舰级 Agent 与软件工程大模型
Xiaomi MiMo-V2.5-Pro 是小米推出的旗舰级 Agent 与软件工程大模型,采用 1.02T 参数 MoE 架构,42B 激活参数,支持最高 100 万 tokens 上下文,适合复杂代码生成、长程智能体任务、工具调用和工程自动化场景。- 4.2k
- 0
-
MiMo-V2.5 - 小米开源的原生多模态 Agent 大模型,支持百万上下文
Xiaomi MiMo-V2.5 是小米 MiMo 团队推出的原生多模态 Agent 大模型,支持视觉、音频、文本等多模态理解,并具备较强的智能体任务处理能力。该模型采用 310B 参数 Sparse MoE 架构,激活参数为 15B,支持最高 100 万 tokens 上下文,适合多模态问答、图像与视频理解、文档分析、图表推理和高性价比 Agent 应用开发。- 5.8k
- 0
-
Kimi 发布并开源 K2.6:Agent、长程编码与多模态能力全面升级
月之暗面正式发布并开源 Kimi K2.6,新模型支持文本、图片、视频输入,强化长程代码执行、Agent 集群协作与多步工具调用能力,并已上线 Kimi、API 和 Kimi Code。- 11.9k
- 0

















