Skip to content

在模型最大输出长度受限的情况下无法正常工作 #245

Description

@BLACKCHARGE

商汤日日新(SenseNova)提供的免费DeepSeek V4 Flash模型最大输出长度被限制到了64K tokens而不是dpsk官方的384K

Image

根据SenseNova官方文档,如果达到了最大输出限制,此时响应结构的的finish_reason会被设置为length,deepcode似乎无法处理这种情况,会认为调用失败了,导致输出的内容无法被写入到文件中,在处理长文本任务如文档翻译时会导致无法正常产生翻译文件,并且会反复循环重试,无法正常完成与结束任务:

Image 使用SenseNova提供的v4-flash时这种情况会一直循环,paper_translation.md并不会真实产生,使用dpsk官方API处理同样的任务就无此问题,可以正常结束任务,以上任务单次思考产生的实际tokens大概是10多K 可能需要对这种情况单独进行处理,增加设置最大输出长度的选项

Metadata

Metadata

Assignees

No one assigned

    Labels

    No labels
    No labels

    Type

    No type

    Projects

    No projects

    Milestone

    No milestone

    Relationships

    None yet

    Development

    No branches or pull requests

    Issue actions