-
Qwen3.8 正式开源:27B 原生多模态模型开放,消费级显卡可部署
阿里正式开源 Qwen3.8 系列,Qwen3.8-27B 采用 270 亿参数原生多模态 Dense 架构,综合能力超过 Qwen3.7-Plus,支持编程、办公和视觉理解,采用 Apache 2.0 协议,量化后可在消费级显卡部署。- 1.3k
- 0
-
Google 发布 Gemini 3.7 Flash:强化 Coding 与 Agent,支持 100 万 Token 上下文
Google 正式发布 Gemini 3.7 Flash,新模型重点强化 AI 编程、Agent 工作流、Web 开发和专业知识处理能力,在多项软件工程与业务自动化测试中明显超过 Gemini 3.6 Flash。模型支持 100 万 Token 上下文,目前已正式 GA,可用于生产环境。- 318
- 0
-
Gemini 3.7 Flash - Google 推出的高效 Coding 与 Agent 模型
Gemini 3.7 Flash 是 Google 推出的新一代高效 AI 模型,重点强化 AI 编程、多步骤 Agent、Web 开发和专业知识工作,支持多模态理解、工具调用和复杂业务工作流,并以更低成本面向开发者和企业提供服务。- 292
- 0
-
Grok 4.6 正式发布:强化长任务 Agent 与 AI 编程,支持 50 万 Token 上下文
SpaceXAI 正式发布旗舰模型 Grok 4.6,重点强化长时间 Agent、AI 编程、知识工作和交互式应用开发能力,支持文本与图像输入以及 50 万 Token 上下文。新模型进一步提升复杂任务的持续执行能力,并已通过 Grok、API 及第三方开发工具提供使用。- 2.1k
- 0
-
Grok 4.6 - SpaceXAI 推出的长任务 Agent 与 AI 编程旗舰模型
Grok 4.6 是 SpaceXAI 推出的旗舰 AI 模型,重点强化长时间 Agent、AI 编程、知识工作和交互式应用开发能力,支持文本与图像输入、50 万 Token 上下文,可处理大型代码库、复杂研究和多步骤任务,并通过 Grok、API 及第三方开发工具提供使用。- 201
- 0
-
Meta 发布开源模型 Muse Glimmer:30B 参数,Apache 2.0 协议,单张消费级显卡可运行
2026 年 8 月 10 日,Meta Superintelligence Labs 发布开放权重多模态模型 Muse Glimmer,这是该实验室成立以来首个公开权重的模型,也是 Meta 首次采用 OSI 认可的 Apache 2.0 协议发布模型,此前 Llama 系列使用的是带月活规模门槛的自定义社区许可。模型从旗舰闭源模型 Muse Spark 蒸馏而来,定位于常驻本地运行的智能体工作…- 714
- 0
-
Muse Glimmer - Meta 开源的 30B 本地智能体模型,单卡即可常驻运行
Muse Glimmer是Meta开源的30B多模态智能体模型,Apache 2.0协议,支持131K上下文与函数调用,24GB显存单卡可本地运行。- 485
- 0
-
阿里发布 Qwen3.8-Max:2.4T 参数旗舰模型,Max 级别首次开源权重
2026年8月3日,阿里巴巴 Qwen 团队今日正式发布 Qwen3.8-Max,这是 Qwen 家族目前规模最大的基础模型。与历代 Max 级模型仅通过 API 提供服务不同,官方明确表示这一级别的权重将首次开源,预计下周在 Hugging Face 与 ModelScope 上线。模型现已通过千问AI平台开放调用,模型 ID 为 qwen3.8-max。 技术规格上,Qwen3.8-Max 基…- 2.7k
- 0
-
Qwen3.8-Max:阿里通义千问推出的新一代旗舰大模型
Qwen3.8-Max 是阿里通义千问旗舰基础模型,总参数2.4T、激活95B,支持百万上下文与三档推理深度,擅长智能体编程与长程自主任务。- 1k
- 0
-
GPT-Live:OpenAI 新一代实时语音交互模型
GPT-Live 是 OpenAI 推出的实时语音交互模型,具备低延迟语音处理、自然连续对话、多模态协同和多语言交流能力,为 ChatGPT Voice、AI助手、语音Agent和智能设备提供实时交互基础。- 1.2k
- 0
-
Seedance 2.5 亮相:字节跳动升级 AI 视频生成能力
2026 年 6 月 23 日,火山引擎在北京举办 2026 夏季 FORCE 原动力大会。会上,字节跳动最新豆包视频生成模型 Seedance 2.5 首次亮相。根据公开报道,Seedance 2.5 当前处于全球企业内测阶段,预计将于 2026 年 7 月初正式上线。 从已公布的信息看,Seedance 2.5 的升级重点主要集中在三个方面:单段原生 30 秒视频直出、最多 50 个全模态素材…- 3.6k
- 0
-
Seed2.1 - 字节面向生产力场景的多模态 Agent 模型,视觉与视频理解突出
Seed2.1 是字节跳动 Seed 团队推出的多模态大模型系列,含 Pro、Turbo 两款尺寸,强化通用 Agent、代码工程与视觉、空间、视频理解能力。在 AIHub 了解 Seed2.1 的特性与接入方式。- 2.1k
- 0
-
Kimi K2.7 Code 发布并开源:面向长程 Coding 与 Agent 任务优化
近日,月之暗面推出新一代代码专用模型 Kimi K2.7 Code。这是 Kimi 系列面向 AI 编程和 Coding Agent 场景的最新模型,已在 Kimi API 平台开放调用,并在 Hugging Face 提供开源权重。 从定位来看,Kimi K2.7 Code 不是普通聊天模型,而是专门面向代码生成、代码库理解、调试重构、多文件修改和复杂软件工程任务优化的 Coding Agent…- 4.3k
- 0
-
Kimi K2.7 Code:月之暗面推出的开源代码专用 Agent 模型
Kimi K2.7 Code 是 Moonshot AI 推出的代码专用 Agent 模型,面向长程编程任务、代码库理解、调试重构和软件工程自动化场景优化。模型采用 MoE 架构,拥有 1T 总参数、32B 激活参数,支持 256K 上下文、文本/图片/视频输入、思考模式、多步工具调用和 OpenAI 兼容 API,已在 Hugging Face 开放权重。- 2k
- 0
-
MiniMax M3发布:前沿 Coding 与 Agent 能力,支持 1M 上下文和原生多模态
MiniMax 正式发布新一代旗舰语言模型 MiniMax M3,主打前沿 Coding、Agentic 能力、1M 上下文窗口和原生多模态能力,支持文本、图片、视频输入和工具调用,适合 AI 编程、智能体开发、长文档处理和复杂任务自动化场景。- 7.3k
- 0
-
MiniMax M3 - MiniMax 发布的原生多模态大模型,支持前沿编程与 Agent 能力、1M 上下文
MiniMax M3 是 MiniMax 发布的新一代旗舰语言模型,主打 Coding、Agentic 能力、1M 上下文和原生多模态能力,适合代码开发、智能体任务、长文档处理、工具调用、多步推理以及图片、视频理解等场景。- 4k
- 0
-
阶跃星辰发布 Step 3.7 Flash:面向真实 Agent 场景的高效率多模态模型
2026年5月29日,阶跃星辰正式发布 Step 3.7 Flash,这是一款面向真实世界 Agent 场景的新一代高效率 Flash 模型。与传统偏问答的模型不同,Step 3.7 Flash 更强调“理解之后执行”,围绕多模态感知、网页与视觉搜索、工具调用、代码执行和 Agent 工作流进行了系统增强。 Step 3.7 Flash 采用稀疏 MoE 视觉语言模型架构,具备文本、图像、代码、搜…- 1.6k
- 0
-
Step 3.7 Flash - 阶跃星辰推出的面向真实 Agent 场景的高效率多模态模型
Step 3.7 Flash 是阶跃星辰推出的高效率 Flash 多模态模型,面向真实世界 Agent、智能编程、视觉搜索、工具调用和企业任务场景,支持 256k 上下文、原生图像理解、可靠工具编排和主流 Agent 生态兼容。- 2.2k
- 0
-
小米 MiMo-V2.5 系列 API 永久降价,最高降幅达 99%
小米 MiMo 官方宣布 MiMo-V2.5 系列 API 永久降价,最高降幅达 99%,Token Plan 用量提升至原来的 5-8 倍,并对当前有效用户 Credits 额度进行全量重置,进一步降低开发者接入 MiMo 系列模型的成本门槛。- 2.4k
- 0
-
Lance - 字节跳动开源的原生统一多模态模型,支持图像与视频理解生成编辑
Lance 是字节跳动开源的 3B 原生统一多模态模型,支持图像生成、视频生成、图像编辑、视频编辑、图像理解和视频理解等任务,适合多模态研究、视觉生成实验和开发者二次开发。- 3.9k
- 0
-
Google 发布 Gemini Omni:从“理解世界”走向“生成世界”的全新多模态模型
Google 在 I/O 2026 上发布 Gemini Omni 多模态模型家族,首发版本 Omni Flash 支持文本、图片、视频和音频输入生成视频内容,并已接入 Gemini App、Google Flow 和 YouTube Shorts,代表 AI 视频模型向全模态生成方向演进。- 1.8k
- 0
-
Google 发布 Gemini 3.5 Flash:面向 Agent 与编程任务的新一代高速模型
Google 在 I/O 2026 上发布 Gemini 3.5 Flash,主打 Agent 执行、复杂编码、长周期任务和多模态理解能力,支持百万级上下文、函数调用、代码执行、文件搜索和搜索增强,适合构建 AI Agent、编程助手和自动化工作流。- 2.6k
- 0
-
Gemini Omni - Google 推出的统一多模态 AI 模型,任意输入生成视频并支持对话式编辑
Gemini Omni 是 Google DeepMind 于 Google I/O 2026 发布的统一多模态模型系列,核心能力是从任意输入(文本、图像、音频、视频)创造任意输出,首发方向为视频生成与对话式视频编辑。该模型将 Gemini 的推理智能与生成媒体模型结合,能模拟真实物理世界、理解历史文化科学背景,并通过自然语言对话实现多轮视频编辑(背景替换、风格迁移、角色调整等),每次编辑在前一次…- 5k
- 0
-
MiMo-V2.5 - 小米开源的原生多模态 Agent 大模型,支持百万上下文
Xiaomi MiMo-V2.5 是小米 MiMo 团队推出的原生多模态 Agent 大模型,支持视觉、音频、文本等多模态理解,并具备较强的智能体任务处理能力。该模型采用 310B 参数 Sparse MoE 架构,激活参数为 15B,支持最高 100 万 tokens 上下文,适合多模态问答、图像与视频理解、文档分析、图表推理和高性价比 Agent 应用开发。- 5.1k
- 0















