会议纪要、写作助手、表格分析等办公套件持续迭代,其中表格分析功能已在抗台风场景中辅助基层干部校对人员转移数据。
AI写的代码,人类已经看不过来了
经常跑数百次工具调用的重度Codex会话的开发者,就会发现界面明显变轻快了,设备的内存占用也随之降了下来。
他们证明了一件让所有创业者热血沸腾的事:在大模型时代,你不一定要有自己的模型,或者烧掉几百亿美金去买算力。
Anthropic表示,其添加水印是为了遵守欧盟的《AI法案》,并计划推出一款免费的应用程序编程接口,允许用户和第三方自行检查文本是否带有Claude的水印。
通过更大规模、更长周期、更多样任务环境的后训练,GLM-5.3 进一步释放模型能力上限:编程能力较上一代提升 50%,并在多项公开基准测试中取得开源模型第一;
SpaceX 两个月前已经宣布与 Cursor 达成收购协议。 收购完成后,Cursor 联合创始人将跻身亿万富翁行列,团队也可以使用SpaceX 储备的大量先进 AI 芯片。 双方在交易正式完成前已经开始…
据公开的基准测试数据,该模型在Agentic terminal coding测试中得分73.0(Qwen3.6-27B为63.4),在SWE-bench Pro测试中得分61.7(Qwen3.6-27B为53.5),在专业工作任务测试JobBench中得分33.4,较Qwen3.6-27B的21.8提升约50%。
财联社8月15日讯(编辑 赵昊)SpaceX已完成对人工智能编程初创公司Cursor的收购,这笔交易是埃隆·马斯克追赶Anthropic、OpenAI等竞争对手的重要一步。
智谱表示,在多项主流基准测试中 GLM-5.3 是当前排名最高的开源模型,编程与智能体能力接近 Claude Fable 5,编程体感超过其他国产模型。
谷歌加速Gemini Flash迭代:编程强化价格减半 旗舰Pro上线时间成谜
而Devin则完全是智能体路线,开发者把一项任务交给它之后,其自主完成后续流程,包括读取工单、探索代码库结构、编写代码、运行测试、发现并修复错误、最终提交代码变更请求。
IT之家 8 月 13 日消息,约克大学与卡尔加里大学研究团队分析了 Reddit 上与编程 AI 问题相关的帖子,发现 AI 智能体因权限过大而覆盖文件、删除重要数据,甚至生成恶意代码。
全球三大顶流模型齐更新
新模型在 Grok 4.5 基础上进一步强化长时间运行的智能体任务,以及复杂的交互和视觉工作。
官方公布的评测覆盖编程Agent、通用Agent、专业工作和长上下文等方向,与Opus 4.8、Fable 5、GPT 5.6 Sol等模型相比,在PaperBench、IFBench等基准测试中取得较高成绩。
凤凰网科技讯 北京时间8月12日,据彭博社报道,瑞典AI编程创业公司Lovable以133亿美元的估值完成了新一轮融资,获得了更多资金以与Anthropic、埃隆·马斯克(Elon Musk)旗下SpaceX等规模更大的对手展开竞争。
Meta的愿景是为数十亿人提供免费Agent
一位熟悉讨论情况的消息人士称,最终的品牌决定可能会改变,SpaceX 甚至可能决定完全采用一个新名称。
相比七月初增长约200万,开发者产品ZCode上线1个月用户突破百万。
谁还和掌舵DeepSeek的“梁圣”公开唱反调
一位研究者写了一篇题为「来自AI的存在风险——写给数学家的说明」的文章,开头就说:「2026年是数学的关键年份。
梗负责让人点进来,代码负责让人留下来
一边是位于加州Mountain View的谷歌总部,掌握着搜索、云、Android等庞大产品和商业体系。
06/25 00:14
06/25 00:13
06/13 18:29
06/13 18:26
06/13 18:25
06/13 18:23
06/13 18:20
06/13 18:16