关注行业动态、报道公司新闻
V4.1-Flash每百万Token闲时缓存射中输入、未射中输入及输出价钱别离为0.02元、1元、4元,较前代的0.05元、1.5元、4.5元别离下降60.0%、33.3%、11.1%,中国AI大模子周挪用量达67.46万亿Token,架构优化推理降本空间。《每日经济旧事》按照OpenRouter最新数据测算,DeepSeek V4.1-Flash升至第一,此中,上周(9月14日至9月20日)全球AI大模子总挪用量为129万亿Token,
高峰时段价钱为闲时的两倍。环比增加1.57%。同时高性价比推理将加快FDE(火线摆设工程师)及企业级Agent(智能体)落地。环比增加10.28%;环比下滑34.7%。同期美国AI大模子周挪用量为14.21万亿Token,
