结对编程」共找到 3097 篇相关文章

算法论文8

一夜200万阅读,OpenAI神同步!这项测评框架让全球顶尖LLM全翻车

中国团队领衔全球24所高校机构发布评测LLMs for Science能力的论文,一夜阅读近200万,同一时间OpenAI也发文指出现有评测标准在AI for Science领域失灵。论文推出评测体系SDE,发现主流大模型在科学发现上短板明显。

新智元
新闻资讯8

Anthropic创始人盛赞Meta:开启广告基础设施「智能体进化」时代

Meta最新论文揭示基于树状思维链搜索的智能体框架,以“无人驾驶”方式重写广告系统底层内核,将内核开发时间从数周缩至数小时,生产环境性能最高提升17倍,Anthropic创始人高度评价。

新智元
新闻资讯7

256G内存条涨到天价:不是内存条疯了,是算力正在变成新土地

近期,256GB内存条单根突破4万元。这并非普通DDR5,而是服务器专用内存。其价格飙升源于供需错配,大模型训练大容量内存需求极端。有人认为是泡沫,也有人觉得是构性变化。

芯师爷
新闻资讯8

从“能用”到“敢用”:企业级 AI 落地的终极答案 | AICon 2025 收官

12月19 - 20日AICon 2025大会落幕,众多企业专家参与,探讨企业级AI落地。InfoQ王一鹏谈AI落地趋势与流畅度构建;大会发布「2025中国技术力量年度榜单」,多位嘉宾演讲分享AI见解,还有17个分论坛和合作展区。

InfoQ
开源动态8

SGLang原生支持昇腾,新模型一键拉起无需改代码

12月20日SGLang AI金融π收官,聚焦大模型推理效率。昇腾成SGLang原生支持后端,助DeepSeek等模型免调参运行。SGLang给出推理系统工程解法,昇腾与SGLang深度共建,性能优且全面拥抱开源。

量子位
新闻资讯7

大模型可否胸有成竹?探索LLM推理与自信心的关系 | 直播预约

本次全英文直播将探讨大语言模型推理能力扩展瓶颈,介绍以置信度为核心的推理视角,展示“自确定性”指标及应用,还会讨论方法有效性和“基于置信度的推理”意义。

深度学习自然语言处理
推荐文章7

AI圈最准的消息,都藏在这个小小的Web3网站里。

文章介绍了Web3平台Polymarket,它能提前预测AI模型发布日期等事件,准确率颇高。其玩法基于群体智慧,参与者用钱下注表达观点,价格反映事件发生概率,比KOL分析更靠谱。

数字生命卡兹克
新闻资讯8

美国视频生成老炮儿,入局世界模型

Runway发布首个通用世界模型GWM - 1及一系列变体,包括GWM Worlds、GWM Avatars、GWM Robotics,均基于Gen - 4.5构建。还Gen - 4.5升级,新增原生音频生成、编辑和多镜头编辑功能。

量子位
新闻资讯7

突发!英伟达H200华解禁,老黄赢麻了

特朗普拍板允许英伟达向中国出售H200,美确保“代差优势”,还抽25%分成。H200性能是H20的6倍,虽落后最新架构,但适合训练推理,此决定或为英伟达带来巨额销售额。

新智元
算法论文8

北航领衔发布300页代码智能综述:从基础模型到智能体,一次读懂Code LLM全景图

北航领衔联合近30家机构撰写《From Code Foundation Models to Agents and Applications》,系统梳理代码智能领域,串联模型、任务等成完整技术链路,还通过实验等给出实践指南。

量子位