DeepSeek V4.1-Flash 正式登陆 WorkBuddy,高速多模态大模型赋能 AI 智能体工作流

技术前沿 ·

近日,DeepSeek全新力作DeepSeek V4.1-Flash正式上线腾讯全场景AI工作台WorkBuddy(含CodeBuddy),作为DeepSeek官方合作平台,用户可直接在WorkBuddy内切换调用该模型,同时平台开启为期两周的限时免费体验活动,开发者与办公用户可零成本体验新一代高速多模态模型能力。

DeepSeek V4.1-Flash并非简单轻量化小模型,而是基于全新Causal Encoder–Decoder(CED)非对称架构打造的MoE模型,总参数规模达552B,采用差异化激活设计:输入理解阶段仅激活8B参数,输出生成阶段激活16B参数。这套架构专门面向Agent智能体长任务场景优化,大幅降低长文本处理过程中的KV缓存开销,相比前代模型,HBM占用缩减至1/4,SSD存储占用仅为原先1/8,显著降低长循环智能体任务的算力与调用成本,在推理速度、吞吐能力与综合性能上,多项基准测试结果超越前代旗舰V4-Pro。官方已宣布,自9月14日起,原有V4-Pro的API请求将自动路由至V4.1-Flash,标志着V4.1-Flash正式成为主力生产模型。

模型原生支持多模态理解,可同时处理文本、图片、截图,支持代码生成、图表识别、截图排错、长文档阅读、复杂多步骤Agent自动化任务。对于开发者,代码编写、仓库解读、调试排错;对于办公人群,长报告研读、数据分析、PPT生成、批量文档处理等场景,V4.1-Flash都能兼顾推理质量与响应速度,非常适配WorkBuddy“一句话下达指令,AI自主拆解、执行、交付完整文件成果”的智能体工作模式。

WorkBuddy作为腾讯推出的AI智能体工作台,核心能力是让AI不局限于对话,而是直接操作本地文件、串联多工具、自动完成多步骤复杂任务,支持文档、表格、代码、数据分析、PPT生成等全场景办公需求,打通GitHub、Notion、企业微信等大量外部工具。本次接入DeepSeek V4.1-Flash,进一步丰富平台模型矩阵,把新一代高速多模态能力直接封装到Agent工作流内,用户无需自行申请API密钥、配置环境,在模型选择器直接选中DeepSeek V4.1-Flash即可启用,降低高性能大模型的使用门槛。

本次上线配套两周限时免费活动,活动期间调用V4.1-Flash不会消耗账户原有积分,普通用户、开发者都可以直接上手实测模型的代码、长文本、图文理解能力。原有的V4-Flash与V4-Flash-Vision-Exp模型已停止维护,在WorkBuddy中调用旧模型标识会自动路由至V4.1-Flash,保证用户任务平滑迁移,无需大幅修改原有任务配置。

对开发者、独立创作者、企业办公团队而言,这次强强联合意义显著。过往使用Agent智能体处理长循环任务,往往面临调用成本高、响应慢、长文本缓存开销大等痛点。DeepSeek V4.1-Flash针对Agent场景优化的架构,叠加WorkBuddy一站式任务执行能力,能够以更低成本完成代码工程搭建、大规模资料研读、多文件批量处理、图文联合分析等重型任务。

随着AI从对话交互走向可落地的自动化智能体,模型不再只比拼基准跑分,速度、成本、长上下文稳定性、多模态原生能力成为核心指标。DeepSeek V4.1-Flash登陆WorkBuddy,是前沿模型能力与落地型Agent工作台的一次深度结合,降低高性能模型的使用门槛,让复杂自动化任务走向更多普通用户与开发团队。

提示:限时免费活动为期两周,活动结束后将恢复正常计费;原有项目可无缝切换至V4.1-Flash,快速获得更快推理速度与更强多模态能力。

阅读 82