
DeepSeek,V4.1,Flash近日上线千问AI平台,API服务与TokenPlan同步开放,开发者可通过标准API接入业务系统,也能在Qoder、千问APP、Codex等工具中直接调用TokenPlan,用于代码、文档、视觉理解与智能体任务,据平台公告,该模型为DeepSeek新一代轻量旗舰,总参数552B的MoE架构,采用C...。
更新时间:2026-09-14 22:30:00

近日,神州光大宣布,基于深圳河套学院AI训练平台项目团队公开论文的技术路径,依托其自有工程体系独立完成复现与优化,在客户真实业务后训练场景中,在国产算力环境下实现MFU,模型算力利用率,稳定达到34%以上,该结果与论文在AscendSuperPOD上取得的34.22%MFU、较开源基线提升2.93倍的技术结论相互印证,标志着相关技术完...。
更新时间:2026-09-14 15:41:57

深度求索今日正式发布了全新模型结构系列中的最小尺寸成员——DeepSeekV4.1Flash,作为一款具备原生多模态视觉理解能力的轻量化模型,其设计初衷旨在实现更高的能力上限、更快的推理速度、更大的吞吐量,并具备向更大参数模型扩展的潜力,在核心架构方面,DeepSeekV4.1Flash采用了552B参数的MoE,混合专家,架构,并创...。
更新时间:2026-09-10 18:20:58

欢迎来到,AI日报,栏目,这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用,新鲜AI产品点击了解,1、Flash发布,原生全面超越Pro版DeepSeekV4.1Flash作为最小尺寸模型,具备原生多模态视觉理解能力,通过创新架构和优化设计,在性能、效率和成本控...。
更新时间:2026-09-10 18:10:50

蚂蚁开源团队正式发布并开源了百灵系列的首个原生多模态大模型Ling,3.0,flash,VL,该模型基于Ling,3.0,flash的MoE架构拓展而来,总参数量达到124B,单次推理激活5.5B参数,原生支持图像、文本与视频输入,且上下文窗口达到了256KToken,在研发过程中,团队重点探索了如何让大模型更可靠、更高效地完成真实任...。
更新时间:2026-09-10 07:15:53