「95后」共找到 1961 篇相关文章
港大赵恒爽团队论文:让扩散模型既拿高分又不「作弊」丨CVPR 2026
扩散模型虽能生成逼真图像,但存在“奖励作弊”问题。港大赵恒爽团队提出 GDRO 后训练方法,引入组级奖励优化机制,提升模型表现、缓解作弊,还提高训练效率,有明显工程价值。
有什么事情是当了程序员之后才知道的?
本文是腾讯程序员分享当程序员后才知道的事,如改一行代码能崩项目、本地部署模型可免费搞定等,还给出多个有趣观点,最后发起评论互动并抽取粉丝送Q币卡。
SFT远不如RL?永不过时的剃刀原则打开「终身学习」大模型训练的大门
现代AI系统学习新任务时会灾难性遗忘旧知识,限制其持续学习能力。麻省理工学院研究者对比SFT和RL后发现,相同性能下RL更不易遗忘,提出遗忘定律,解释了RL优势源于其on - policy特性。
任务自适应 Harness:从 Trace 到多 Coding Agent 的协作记忆
作者为AI Coding准备的端到端方案未落地,后在Routa项目找到新落点。基于ACP协议的Agent Trace可记录关键行为,用于分析优化。还介绍了Feature Explorer、Kanban Harness及任务自适应Harness,探讨多Agent协作记忆。
静态稀疏已死:Flux Attention 开启长文本 LLM 自适应推理新时代
文章指出长上下文LLM高效推理面临性能与效率难题,先介绍Elastic Attention打破静态稀疏桎梏,后重点阐述全新的Flux Attention,它将动态稀疏注意力范式升级为层级别路由,解决了算法与硬件的矛盾,在多方面实现突破。
手撕Sora,脚踢Veo!13个行业实战案例,Seedance 2.0玩法大全
本文是藏师傅对 Seedance 2.0 的测评和教学,介绍其 API 春节后将上线火山引擎,支持全模态输入。通过 13 个行业实战案例展示该模型能力,如生成广告、宣传片、教学视频等,还提及 Agent 自动化应用。
Claude写完代码不直接交了:4个Skill自查一遍,改好再找你
Anthropic将AI验收纳入循环,让Claude写完代码后进行四道检查才交付,定义了验证循环,Claude Code团队有4个自查Skill,还介绍了写验证Skill的方法、触发设置,AI编程竞争正从生成转向验证。
OpenClaw 之后我开始思考:Agent 最重要的两种能力是什么?
OpenClaw爆火后,作者思考AI Agent除执行能力外,还需审美判断力。介绍Seede AI,它与文生图工具不同,能将内容转化为可编辑设计文件,操作简单,效果惊艳,有独特技术逻辑,未来有风格预设等发展方向。
我们真的变成巫师了:OpenAI API 负责人谈 AI 如何重塑软件工程
OpenAI API 负责人 Sherwin Wu 在 Lenny's Podcast 上分享,OpenAI 内部 95% 工程师用 Codex,100% PR 由其审查。他谈了 AI 重塑软件工程的现状、未来趋势,提及管理变化、创业效应、部署问题等,也为创业者给出建议。
社区供稿丨以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度
近年来大语言模型发展陷入‘参数军备竞赛’,成本高昂。Boss直聘南北阁实验室发布Nanbeige4 - 3B,仅30亿参数,在预训练和后训练阶段采用多种创新技术,在多方面媲美甚至超越大模型。