从生成式 AI 到智能体 AI,再到初露锋芒、热度持续攀升的物理 AI,每一代形态跃迁的背后,都是推理算力需求的指数级增长与架构能力的全面升级。未来十年,支撑中国 AI 产业持续发展的将是规模化、高性价比的推理基础设施。“曦望想做的,就是为这个基础设施添砖加瓦。安安静静、踏踏实实地,把推理成本一步步打下来,把服务做扎实。让每一个开发者、每一家企业,不用再被算力卡脖子,不用再为 Token 账单发愁,能放开手脚去做自己想做的事”,徐冰说。
要知道,在本次连续两日降价之前,DeepSeek-V4的价格本就极具“杀伤力”。同样处理百万Token的输入与输出,GPT-5.5和Claude Opus 4.7的合计成本分别是35美元和30美元。而DeepSeek-V4-Pro仅需5.27美元。如果输入命中缓存,输入价格进一步降至每百万Token 0.145美元,合计成本降至3.66美元。
也就是说,在标准定价下,DeepSeek-V4-Pro的成本大约是GPT-5.5的七分之一、Claude Opus 4.7 的六分之一。如果缓存命中,则大约是GPT-5.5的十分之一、Claude Opus 4.7的八分之一。而DeepSeek-V4-Flash的输入价格每百万Token仅0.145美元,输出价格0.293美元,合计0.439美元。缓存命中后进一步降至0.322美元。而现在,降价叠加限时优惠,DeepSeek-V4-Pro输入缓存命中的价格已降低至0.025元/百万Token,为原价的四十分之一。
通过上表可以看到,从公开API单价看,DeepSeek-V4系列已进入全球主流高性能模型中的最低价格带。尤其是在输入缓存命中场景下,V4-Pro限时价降至0.0037美元/百万Token,V4-Flash更低至0.0029美元/百万Token,显著低于GPT-5.5、Claude Opus 4.7、Gemini 2.5 Pro等一线闭源模型。不过,若按完整任务成本计算,模型输出Token数、推理长度和任务类型仍会影响最终账单。
研究团队发表在欧洲肿瘤内科学会官方期刊《肿瘤学年鉴》(Annals of Oncology,影响因子65.4)上的论文显示,DAMO COCA模型的敏感性(即防止漏诊的能力)达到86.6%,特异性更达到99.8%,即误诊率仅有0.2%。与10名不同年资的影像科医生相比,DAMO COCA模型的敏感性显著高出20.4%,在乙状结肠、直肠等易漏部位上的表现尤为突出。而在AI辅助下,医生的敏感性和特异性可分别提高14.5%和3.1%,有效减少临床漏诊。