等了四个月,DeepSeek的多模态模型:deepseek-v4-flash-vision-exp,终于发布。
不过现在就简单多了,大伙儿想体验的,只要把 DSH 更新一下,就能在模型选择栏看到 “ deepseek-v4-flash-vision-exp ” 了。
据官方介绍,用户可以通过设置 model='deepseek-v4-flash-vision-exp' 来访问 V4-Flash-Vision-Exp 模型的 API。
国产模型整体仍处于中上游位置。
彻底转向
Agent时代,怎么挑选“智效比”模型。
当地时间8月13日,谷歌发布新模型Gemini 3.7 Flash,相比性能提升,更受开发者关注的是一项限时促销:今年年底前,该模型每百万token的输入、输出价格分别为0.75美元和3.75美元,只有Gemini 3.6 Flash标准价格的一半。
谷歌Gemini 3.7 Flash发布:代码质量提升,助力开发者高效开发降成本
IT之家 8 月 14 日消息,当地时间 8 月 13 日,谷歌宣布推出 Gemini 3.7 Flash 模型,专为编程与 Agents 场景打造。
谷歌加速Gemini Flash迭代:编程强化价格减半 旗舰Pro上线时间成谜
Gemini新官上任后的第一把火
快科技8月13日消息,DeepSeek昨天夜里放大招,低调上线了DeepSeek V4-Pro-0813正式版,官方测试性能提升很大,直逼Fable 5。
反直觉,斩杀线其实会越来越低
从目前公布的信息来看,deepseek-v4-pro 支持 1M 上下文长度,最大输出长度达到 384K Token,同时支持非思考模式和思考模式,其中思考模式默认开启。
代价也是不言而喻的,Token 会迅速上涨
本周前端开发榜榜首依旧是 claude-opus-5-max,ELO 1686 分,月之暗面 kimi-k3-max 稳定保持第二位,ELO 1675 分,仅下跌 1 分,仍紧逼头部海外模型。
在钟新龙看来,国内AI企业可以利用该正式版发布的窗口吸引全球开发者,并由低价API(应用程序接口)服务逐步延伸至推理工具链、行业解决方案等高附加值环节,扩大发展空间。
其中,上榜的AI大模型中,中国AI大模型周调用量达34.25万亿Token,环比增长21.76%;
简单概括一下目前爆出的内容:200 万 token 上下文窗口、更快的推理速度和更低延迟、长上下文推理与多步规划能力增强、浏览器和终端等工具调用大幅改善。
但即便如此,这一差距仍可说明:降价未能有效遏制开发者向国产开源模型迁移的趋势。
这次测评和以前不一样,把传统代码生成升级成智能体编程,权重直接给到25%,更贴合程序员真实开发流程。
当前,DeepSeek的API价格按“输入Token”和“输出Token”分别计费,且根据“缓存命中”与“缓存未命中”情况,价格有所差异。
一名接近DeepSeek的投资人在7月下旬告诉《财经》,近期DeepSeek训练新模型的压力并不小。
这个时候DeepSeek官方也没办法了,甚至建议用户去使用别家的大模型,切换到其他大模型服务商。
AI的黄金时代,现在才刚刚开始
虽然目前仍属于单一商业空间的探索尝试,但随着大模型推理成本持续下降,未来可能会有更多咖啡酒吧、共享办公室将 AI 算力作为探索新方向。
KIOXIA GP1 固态硬盘是一款突破性产品,它将催生一种全新的、领先的人工智能内存拓扑结构,并展现了铠侠对推进人工智能发展的持续承诺。
IT之家 8 月 4 日消息,根据全球最大 AI 聚合平台 OpenRouter 的周度统计中,DeepSeek-V4-Flash 以 7.22 万亿 Token 的调用量位居全球第一。
06/25 00:14
06/25 00:13
06/13 18:29
06/13 18:26
06/13 18:25
06/13 18:23
06/13 18:20
06/13 18:16