开源编程模型」共找到 9437 篇相关文章

产品应用8

字节押注AI Coding:百万月活的TRAE,如何改写开发者生态?|甲子光年

字节跳动在火山引擎Force 2025原动力大会主推自研AI编程产品TRAE,其月活超百万,内部80%工程师在用。AI Coding能提升大模型能力,助字节逼近AGI。TRAE更新功能,未来或成独立开发超级个体。

甲子光年
新闻资讯8

OpenAI深夜祭出GPT-5,所有人能免费用!Altman:像和博士级专家对话

北京时间8月8日凌晨,OpenAI推出GPT - 5,宣称其更智能、准确,幻觉率低。还推GPT - 5 - mini和GPT - 5 - nano两款新模型,免费用户可使用部分版本。它在编程和健康领域测试表现出色,引发各界热议。

InfoQ
算法论文8

颠覆搜索引擎,下一代Agentic Deep Research!12家顶尖学术机构联手提出

在信息获取方式变革背景下,12家顶尖机构联合发布论文提出Agentic Deep Research,它由大模型驱动,可自动规划检索路径等,或颠覆传统搜索范式,且有基准成绩和TTS Law支撑,开源生态也在聚焦。

新智元
算法论文8

无损减少80%激活值内存,提升5倍训练序列长度,仅需两行代码

港中文(深圳)和上海交通大学团队提出 StreamBP 算法,通过线性分解和分步计算,将大语言模型训练激活值内存降至梯度检查点的 20%,在相同内存下最大序列长度为其 2.8 - 5.5 倍,代码已开源

机器之心
算法论文8

MSRA首测AI从零建仓库:能写、能跑,但不一定对丨ACL'26

微软亚洲研究院工作RepoGenesis被ACL 2026高分录用,它是面向多语言、仓库级、端到端Web微服务生成的基准。输入贴近实际,用多维度评测开源Agent和商业IDE,还拓展模型微调。但也有边界,未模拟真实复杂需求。

量子位
开源动态8

AI点外卖哪家强,美团LongCat团队做了个全面评测

美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源

量子位
开源动态8

看完Kimi K2.5技术报告,它的视觉Agentic真给我惊到了

Moonshot AI发布Kimi K2.5技术报告,该模型将文本和视觉打通,有并行执行的智能体集群系统。它采用Joint Training,提出“Zero-Vision SFT”,用MoonViT - 3D处理图像和视频,开源后受欢迎,展示通用智能体可能。

PaperAgent
新闻资讯8

Anthropic逼急谷歌!布林下场亲自督战,组「追杀队」围剿Claude

谷歌联合创始人布林亲自督战,组建攻坚队「追杀」Anthropic,欲夺回编程能力差距。Claude在编程领域锋芒正劲,谷歌AI编码占比仅50%,而Anthropic已达100%。攻坚队聚焦长期写代码任务,策略转向优先训练内部代码模型

新智元
开源动态7

4 万星开源项目被指造假!MemGPT 作者开撕 Mem0:为营销随便造数据,净搞没有意义的测试!

高人气开源智能体记忆项目 Mem0 发布论文,称在 LOCOMO 测试打败对手。MemGPT 创始团队 Letta AI 联合创始人公开指控其造假,称测试无意义,自己轻松超其基准数据。二者都为解决大模型长期记忆问题而诞生。

InfoQ
新闻资讯8

TypeScript 之父 Anders Hejlsberg:别折腾“AI新语言”了,真正变天是 IDE 让位给 Agent

TypeScript 之父 Anders Hejlsberg 在与 GitHub 研究顾问对谈中回应质疑,称选 Go 重写编译器合理。他认为 AI 编程时代,TypeScript 语言服务将重塑,IDE 或让位给 Agent,还谈到 AI 在代码迁移中的应用及开源可持续性问题。

InfoQ