
蚂蚁百灵昨日发布Ling-3.1-flash模型,凭借约560B总参数和每Token约25B激活参数的设计,在模型规模与运行效率之间寻求平衡。该模型上下文窗口上限达1M,意味着它能一次处理更长文档、更复杂代码以及更完整的任务历史,适合长链路、多步骤的智能应用。
在能力打磨上,官方称研发团队围绕通用智能体、搜索、日常办公和软件研发等任务持续优化,并面向医疗、金融和材料科学研究等专业场景提升表现。这意味着Ling-3.1-flash不仅关注通用对话,也试图深入行业工作流,为复杂任务提供支持。
为让更多用户体验,Ling-3.1-flash将开放为期两周的免费体验。不过,考虑到综合服务成本,免费体验期间模型服务长度为256K,用户暂时无法直接使用完整的1M上下文能力。这一安排也在一定程度上反映出长上下文服务背后的算力与成本压力。
免费体验期结束后,该模型将转为付费服务。届时团队计划开放1M上下文,并同步推进开源,同时继续更新模型性能。随着更长上下文和开源计划落地,Ling-3.1-flash能否在智能体与行业应用中形成竞争力,值得持续关注。
原创文章,作者:AI,如若转载,请注明出处:https://www.kejixun.co/article/763931.html