00后」共找到 1933 篇相关文章

新闻资讯7

突发!奥特曼豪宅遭二次袭击,燃烧弹之又是深夜枪响

奥特曼家继上周五遭燃烧弹袭击,周日凌晨又被开枪袭击。警方锁定车辆并逮捕两名嫌疑人。奥特曼曾发文感化仇恨者但无效,AI末日论者认为科技大佬推动AI有风险,呼吁采取紧急措施。

新智元
算法论文8

全球排名前三,复旦自进化Harness Engineering让GPT‑5.4再涨7个点

2026 年以来,Harness Engineering 成业界热词。复旦大学等团队提出 Agentic Harness Engineering (AHE),可实现 Harness 自动优化。实验中,AHE 让 GPT - 5.4 分数提升,适配 GPT - 5.5 排名全球第三,且有良好泛化能力。

机器之心
产品应用8

万相2.6 X千问APP,功能价值和情绪价值兼具|甲子光年

12月16日阿里发布视频生成模型“万相2.6”,实现“角色扮演”功能突破。千问APP接入上线“AI小剧场”,打破次元壁。千问兼具功能与情绪价值,阿里全栈布局助力其成“超级入口”。

甲子光年
算法论文7

一文解读 LLM Posting-Train技术

文章解读了大语言模型训练(Post-training)技术,介绍其核心价值,从微调、强化学习、测试时拓展三方面展开,分析现有技术瓶颈,指出前沿研究方向,还给出实践指南和工具链推荐。

海边的拾遗者
产品应用8

Agnes AI 实测:AI 编程真正的瓶颈,99%的人想错了

本文实测Agnes AI,指出AI编程瓶颈在于缓存命中率,而非模型智商。介绍其产品线、评测成绩与价格优势,还分享客户端体验,包括亮点、回滚事故及日志结论,最点明智能免费验证更稀缺。

AI科技评论
算法论文8

港大赵恒爽团队论文:让扩散模型既拿高分又不「作弊」丨CVPR 2026

扩散模型虽能生成逼真图像,但存在“奖励作弊”问题。港大赵恒爽团队提出 GDRO 训练方法,引入组级奖励优化机制,提升模型表现、缓解作弊,还提高训练效率,有明显工程价值。

AI科技评论
推荐文章7

有什么事情是当了程序员之才知道的?

本文是腾讯程序员分享当程序员才知道的事,如改一行代码能崩项目、本地部署模型可免费搞定等,还给出多个有趣观点,最发起评论互动并抽取粉丝送Q币卡。

腾讯技术工程
算法论文8

SFT远不如RL?永不过时的剃刀原则打开「终身学习」大模型训练的大门

现代AI系统学习新任务时会灾难性遗忘旧知识,限制其持续学习能力。麻省理工学院研究者对比SFT和RL发现,相同性能下RL更不易遗忘,提出遗忘定律,解释了RL优势源于其on - policy特性。

机器之心
推荐文章7

任务自适应 Harness:从 Trace 到多 Coding Agent 的协作记忆

作者为AI Coding准备的端到端方案未落地,在Routa项目找到新落点。基于ACP协议的Agent Trace可记录关键行为,用于分析优化。还介绍了Feature Explorer、Kanban Harness及任务自适应Harness,探讨多Agent协作记忆。

phodal
算法论文8

静态稀疏已死:Flux Attention 开启长文本 LLM 自适应推理新时代

文章指出长上下文LLM高效推理面临性能与效率难题,先介绍Elastic Attention打破静态稀疏桎梏,重点阐述全新的Flux Attention,它将动态稀疏注意力范式升级为层级别路由,解决了算法与硬件的矛盾,在多方面实现突破。

深度学习自然语言处理