通过更大规模、更长周期、更多样任务环境的后训练,GLM-5.3 进一步释放模型能力上限:编程能力较上一代提升 50%,并在多项公开基准测试中取得开源模型第一;
实验现场,是一个名叫「proj-claude-maintains-apps」的Slack频道。
Agent时代,怎么挑选“智效比”模型。
当地时间8月13日,谷歌发布新模型Gemini 3.7 Flash,相比性能提升,更受开发者关注的是一项限时促销:今年年底前,该模型每百万token的输入、输出价格分别为0.75美元和3.75美元,只有Gemini 3.6 Flash标准价格的一半。
谷歌Gemini 3.7 Flash发布:代码质量提升,助力开发者高效开发降成本
需要核对附件、阅读长文或并排查看信息时展开主屏,4:3比例提供更舒展的内容空间。 对于经常同时处理工作与个人日程的人,这些能力不会改变手机的基本使用方式,却能减少复制地址、重输条件和返回核对等重复动作,让大…
IT之家 8 月 14 日消息,当地时间 8 月 13 日,谷歌宣布推出 Gemini 3.7 Flash 模型,专为编程与 Agents 场景打造。
谷歌加速Gemini Flash迭代:编程强化价格减半 旗舰Pro上线时间成谜
Gemini新官上任后的第一把火
快科技8月13日消息,DeepSeek昨天夜里放大招,低调上线了DeepSeek V4-Pro-0813正式版,官方测试性能提升很大,直逼Fable 5。
IT之家 8 月 13 日消息,韩国人工智能实验室 Upstage 今天(8 月 13 日)发布博文,宣布推出 Solar Pro 4 模型,定位为面向复杂 AI 智能体任务的商用大模型。
IT之家 8 月 13 日消息,约克大学与卡尔加里大学研究团队分析了 Reddit 上与编程 AI 问题相关的帖子,发现 AI 智能体因权限过大而覆盖文件、删除重要数据,甚至生成恶意代码。
反直觉,斩杀线其实会越来越低
从目前公布的信息来看,deepseek-v4-pro 支持 1M 上下文长度,最大输出长度达到 384K Token,同时支持非思考模式和思考模式,其中思考模式默认开启。
代价也是不言而喻的,Token 会迅速上涨
在体验方面,本次更新主要打破了浏览器和 Claude 其它平台的数据壁垒,浏览器内的任务和对话现可跨 Claude 桌面端、网页端及移动端无缝同步。
它的完整程度,超出了大多数人对AI工具的想象
AMD收购Taalas:当AI芯片走向极端专用化,“拖拉机”能否耕出新市场?
其中一家安全公司的扫描器执行了恶意代码,导致凭证外泄,Claude随后又利用这些凭证进入了该公司的其他基础设施。
上天入海,AI算力寻找新大陆。
一家估值一度被传到 20 亿美元、却始终没有正式名字的 AI 公司,终于露出了全貌。
此前,Cloudflare曾预计机器生成的流量将在2027年超过人类流量,但事实上这一转变在已提前到2026年5月发生。照这么涨下去,5年后机器流量会是人类的1000倍。 被1000倍的机器流量稀释,你在…
06/25 00:14
06/25 00:13
06/13 18:29
06/13 18:26
06/13 18:25
06/13 18:23
06/13 18:20
06/13 18:16