大家好,我是程序员鱼皮。 前段时间我写过 ,说自己在 DeepSeek Harness 的开源仓库里发现,官方竟然偷偷做了桌面端。 当时官方没有放出安装包,我是让 AI 帮忙把源码拉到本地编译,才跑起来的。 没想到才过了十来天,DeepSeek ...
2026年9月,AI圈突然安静了一秒——然后集体刷屏。不是因为某家大厂又发了千亿参数模型,也不是哪位顶流科学家拿了图灵奖,而是千问AI平台悄悄上线了一个‘润物细无声’却足以改写开发节奏的狠角色:DeepSeek-V4.1-Flash。没错,它来了,不带烟雾弹,不搞饥饿营销,就那么稳稳地插进开发者日常的代码编辑器、终端窗口和移动端App里——像给AI基建装上了涡轮增压+无感启停系统。
DeepSeek-V4.1-Flash is available now on Baseten Model APIs, Baseten announced on September 11, 2026, bringing the 552B-parameter multimodal mixture-of-experts (MoE) model, which pairs 8B active ...
DeepSeek has put the formal version of its V4-Flash API into public beta, with an upgrade focused on agent tasks. The company says the model scored 82.7 on Terminal Bench 2.1 and 54.4 on DeepSWE, ...
文章浏览阅读140次。2026年9月1日到11日,海内外7家头部模型厂商迭代了新模型。过去大模型的升级周期以年计算,后来缩短到几个月,如今已经开始以周为单位。据OpenRouter平台数据,DeepSeek V4.1 ...
克雷西发自凹非寺量子位|公众号QbitAI大模型训练拼的是算力,Agent训练拼的是环境。环境怎么造?梁文锋署名的DeepSeek最新论文,把技术细节公开了。DeepSeek做的这个系统叫DSec(DeepSeekElasticCompute),干的事情就是给Agent训练批量制造沙盒。
就在刚刚,DeepSeek 开启了新模型 DeepSeek V4.1 Flash 的限时内测。 官方称,这是一个面向用户开放测试的中间版本,采用新的模型结构,原生支持多模态。按照 DeepSeek 给出的信息,新模型不仅能力更强、生成速度更快,使用成本也将进一步降低。 用户现在已经可以接入 API,原有的 base_url 无需修改,只要将模型名称设置为 ...