3、本地与边缘部署:在FP8精度下,Ling-3.0-tiny在DGX Spark上的推理吞吐量可达100–105tokens/s,而在M4 Pro MacBook上则为86–90tokens/s,且在8K上下文长度时,峰值内存占用仅为8.34GiB。
Meta的愿景是为数十亿人提供免费Agent
DeepSeek 在询问中回复称:“取外号”的真相是“打标签”,在这个推理过程中,确实会在心里临时给问题打个标签,比如:“这位用户喜欢刨根问底”(对应你)、“这位在故意刁难我”(对应某些测试题)。
简单概括一下目前爆出的内容:200 万 token 上下文窗口、更快的推理速度和更低延迟、长上下文推理与多步规划能力增强、浏览器和终端等工具调用大幅改善。
Meta版Code来了
依托Hy3基座大模型打通声学识别与语义理解,彻底摆脱传统语音识别生硬转写短板,在多方言口音、嘈杂收音、远距离拾音等复杂场景稳定输出精准文本。
模型大战,终究是入口和生态大战
该模型基于最新大语言模型Hy3,融合语音识别与深度语义理解,旨在从“逐字转写”演进为“理解语境、兼容场景”。
Hy3是腾讯混元于7月6日正式发布的MoE架构大模型,整体参数规模295B,动态激活参数21B,最高支持256K超长上下文读取。
它能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。
在未调整优化前,GPT-5.6 Sol 在 ARC-AGI-3 基准测试中的得分为 7.8%,而 GPT-5.5 模型的得分只有 0.4%。
OpenAI的端到端服务成本降低了20%,Token生成效率也提升了15%以上
OpenAI计划向10万名科学家免费开放GPT-5.6系列等资源
DeepSeek的Harness工具这回真的要来了
既是交付最后端,也是输入信息的最前端
开源了,但它不是一台个人电脑上的模型
OpenAI引入两种转录模型:低延迟、更好理解上下文
全球首个Agentic扩散模型来了:边行动边纠错,128K上下文追平自回归
全球最大2.8万亿参数大模型Kimi K3今晚正式开源:性能坐稳前三
将机器人上下文扩展3个数量级。
腾讯WorkBuddy正式上架:鸿蒙平台首个桌面办公智能体
天才”杨植麟,技术与商业的双重底色。
腾讯张军:混元大模型Hy3限时免费再延长两周至8月5日
月之暗面正式上线了 Kimi K3
上传用户代码事件后,马斯克宣布开源Grok Build编程AI智能体工具
海外模型的发布节奏似乎又回到了一年前,你追我赶的快节奏
神秘Opus 5意外曝光!达里奥紧急开会
Claude Sonnet 5上线后遭大量投诉:总爱唱反调,还想教用户做事
06/25 00:14
06/25 00:13
06/13 18:29
06/13 18:26
06/13 18:25
06/13 18:23
06/13 18:20
06/13 18:16