-
火山引擎 - 字节跳动旗下企业级云与AI服务平台
火山引擎是字节跳动旗下企业级云与AI服务平台。聚焦大模型核心能力,依托字节自研豆包多模态大模型,凭借火山方舟一站式平台,提供模型精调、推理部署、智能应用搭建等全链路服务,结合高性能AI算力,助力各行业快速落地大模型数字化与智能化应用。- 90
- 0
-
Google 发布 Gemini 3.8 Live,实时语音 AI 可边对话边推理
Google 正式发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时语音模型,分别面向低延迟语音交互和复杂多步骤语音 Agent 场景。新模型支持实时视觉理解、多语言切换、工具调用,其中 Extended Thinking 可在保持语音交流的同时进行后台推理和异步任务执行。- 183
- 0
-
Gemini 3.8 Live - Google 推出的新一代实时多模态语音模型
Gemini 3.8 Live 是 Google 推出的实时音频对音频模型,面向语音智能体与实时对话场景,支持视觉理解、97 种语言自动切换、异步工具调用和实时多模态交互;同时推出 Extended Thinking 版本,为复杂任务提供后台持续推理与多步骤执行能力。- 46
- 0
-
科大讯飞推出 AStudio:面向复杂任务的新一代全场景 AI 生产力工作台
科大讯飞近日推出全新 AI 生产力产品 AStudio,可根据用户目标自主规划并执行复杂任务,支持资料调研、文档与表格制作、网页开发、数据分析、代码处理及本地项目操作,并可通过自动化任务、插件和个人技能扩展工作能力。- 150
- 0
-
AStudio - 科大讯飞推出的全场景 AI 生产力工作台
AStudio 是科大讯飞推出的全场景 AI 生产力工作台,可自主规划并执行复杂任务,支持文档、表格、网页、图片、代码生成,以及本地文件操作、浏览器自动化、定时任务、插件和技能扩展。- 128
- 0
-
文朵朵AI办公平台 - 真正干活的桌面端Agent办公助手
文朵朵是真正干活的桌面端Agent办公助手:把需求说给它,Agen自主规划并产出可编辑的 PPT、表格、文档与图片还原;成品不满意?继续对话,它改到满意为止。登录就送积分,即开即用。- 209
- 0
-
DeepSeek V4.1 Flash正式发布:原生支持多模态,API 成本进一步降低
DeepSeek 正式发布 V4.1 Flash 模型,采用全新的非对称 Causal-Encoder-Decoder 架构,总参数量为 552B,输入激活 8B、输出激活 16B。新模型原生支持视觉理解,并通过压缩 KV Cache、优化推理效率和下调 API 价格,进一步降低 AI Agent、编程及长上下文任务的使用成本。- 3k
- 0
-
Xiaomi MiMo 桌面客户端开放邀测,两款 MiMo-X 新模型同步亮相
2026年09月08日,小米宣布,Xiaomi MiMo Desktop 桌面客户端正式开放邀请测试,并同步提供两款新一代模型 Preview 版体验,代号分别为 MiMo-X-Pro-Preview 和 MiMo-X-Flash-Preview。 MiMo Desktop 面向办公、研究、设计和编程等真实工作场景。用户可输入表格、图片、视频、PDF、录音及压缩包等素材,通过自然语言说明目标,由客…- 1.2k
- 0
-
MiMo Desktop - 小米推出的桌面 AI 工作助手,多智能体协作与成果交付
MiMo Desktop 是小米推出的桌面 AI 工作助手,支持读取文档、表格、图片、音视频等素材,通过自然语言指令完成任务规划、工具调用与成果制作。提供交互式预览、局部修改、版本回退和多智能体协作,适用于办公、研究、设计与编程,目前采用申请邀测方式开放。- 673
- 0
-
-
OpenAI发布GPT-6 Astra:面向复杂端到端任务的新一代旗舰模型
OpenAI正式发布旗舰模型GPT-6 Astra,重点强化计算机与浏览器操作、软件工程、科学推理和专业办公能力。该模型支持105万tokens上下文,将分批向ChatGPT付费用户、OpenAI API及Amazon Bedrock开放。- 3.3k
- 0
-
GPT-6 Astra - OpenAI 推出的新一代旗舰大模型
GPT-6 Astra 是 OpenAI 面向复杂端到端任务推出的旗舰推理模型,重点强化计算机与浏览器操作、软件工程、科学研究和专业办公,可在长流程中调用工具并生成文档、表格、演示文稿等成品,适合开发者、研究人员及企业知识工作者。- 556
- 0
-
Gemini 3.8 Flash - Google 推出的新一代高效多模态模型
Gemini 3.8 Flash 是 Google 推出的新一代高效多模态模型,重点提升长程软件工程、自主智能体、工具调用和复杂专业推理能力,并支持百万级上下文。同期推出的 Flash Cyber 专注漏洞发现与自动修复,目前仅通过 Fairwind Program 向可信网络安全机构开放。- 216
- 0
-
腾讯 WorkBuddy 开放平台上线:向硬件、行业应用和开发者开放 Agent 能力
腾讯 WorkBuddy 正式上线开放平台,面向智能硬件、行业应用和开发者开放底层 Agent 能力,首批引入超百家生态伙伴,并开放 Buddy 应用、专家、Skill、连接器和硬件五大生态能力,推动 WorkBuddy 从桌面办公智能体进一步向 Agent 生态平台扩展。- 1.5k
- 0
-
Anthropic发布Claude Fable 5.1:复杂任务能力升级,缓存成本降低75%
Anthropic正式发布Claude Fable 5.1,重点提升长周期智能体编程、多步骤研究及专业知识工作能力,支持100万Token上下文和12.8万Token输出。模型维持原有API价格,缓存读取成本降低75%,现已面向Claude付费用户及API客户开放。- 1.2k
- 0
-
DeepSeek-V4-Flash-Vision-Exp开放模型权重,采用MIT协议开源
DeepSeek正式开放DeepSeek-V4-Flash-Vision-Exp模型权重及参考推理代码,采用MIT协议,支持多模态Agent研究、私有化部署与二次开发。- 1.3k
- 0
-
腾讯发布并开源 Hy4 preview:770B参数、1M上下文,强化编程与科研能力
腾讯混元发布并开源新一代旗舰模型 Hy4 preview,采用770B总参数、49B激活参数的MoE架构,支持1M Tokens上下文,重点提升软件工程、办公分析、游戏开发与科学研究能力,现已上线腾讯云和OpenRouter。- 1.1k
- 0
-
阿里发布Qwen3.8-Flash:新架构降低训练成本,API输入每百万Tokens仅1元
8月26日晚,阿里通义千问团队正式发布全新多模态 MoE 模型 Qwen3.8-Flash。该模型主模型参数量为 125B,额外配备 51B N-gram Embedding,每 Token 仅激活 6B 参数,原生支持 262,144 Tokens 上下文,并可通过 YaRN 扩展至100万 Tokens。 Qwen3.8-Flash 围绕 Attention、Residual、Embeddin…- 2.2k
- 0
-
Qwen3.8-Flash:阿里通义千问最新推出的多模态大模型
Qwen3.8-Flash-Next 是阿里通义千问推出的开放权重多模态 MoE 模型,预览 Qwen4 架构,支持编程、办公智能体、图像视频理解及百万级上下文。- 887
- 0
-
智谱发布 GLM-5.3-Flash:GLM-5 系列首款原生多模态模型
2026年08月26日,智谱 AI 正式发布 GLM-5.3-Flash,也就是此前受到行业关注的“ox-alpha”。这是 GLM-5 系列首款原生多模态模型,面向 Coding、Agent 和专业生产力任务,在保持较强模型能力的同时,进一步降低推理与使用成本。 GLM-5.3-Flash 采用 320B 总参数、18B 激活参数的 MoE 架构,并在 GLM 系列中首次结合稀疏注意力与线性注意…- 2.9k
- 0
-
GLM-5.3-Flash - 智谱推出的高性价比原生多模态模型
GLM-5.3-Flash 是智谱 AI 推出的 GLM-5 系列首款原生多模态模型,拥有 320B 总参数和 18B 激活参数,支持 100 万 token 上下文。模型聚焦编程、智能体与专业办公任务,通过混合注意力架构降低推理成本,并以 MIT 协议开放模型权重。- 814
- 0
-
豆包工作正式上线:支持电脑操作与团队协作
8 月 25 日,字节跳动正式上线 AI 办公产品“豆包工作”,面向个人与企业团队提供智能任务执行服务,推动豆包从传统对话助手进一步升级为能够处理实际工作的 AI 智能体。 豆包工作的核心是“工作任务”模式。用户通过自然语言描述需求后,AI 可自主理解目标、拆解任务,并调用本地电脑、浏览器、文档、表格和 PPT 等工具完成操作,适用于资料搜集、数据分析、报告撰写、演示文稿制作和文件整理等场景。 在…- 2.5k
- 0
-
DeepSeek-V4-Flash-Vision-Exp 上线,开放多模态 API服务
DeepSeek 上线实验性多模态模型 DeepSeek-V4-Flash-Vision-Exp,在保持 V4-Flash 文本能力的同时加入视觉理解,可处理图片分析、PPT 制作、网页重构和前端开发等任务。目前模型已开放 API,支持图文混合输入与 Files API。- 2.8k
- 0
-
DeepSeek-V4-Flash-Vision-Exp:DeepSeek推出的多模态视觉理解模型
DeepSeek-V4-Flash-Vision-Exp 是一款面向多模态 Agent 场景的实验性视觉理解模型,在保持 V4-Flash 文本能力的同时支持图文混合输入,可用于图片分析、商业 PPT、网页重构、前端开发及自动化工作流,主要通过 DeepSeek API 向开发者提供。- 829
- 0

















