「上下文学习」共找到 1970 篇相关文章
人大高瓴赵鑫团队新作:先拆掉 RLVR,再重建推理模型训练
人大高瓴赵鑫团队围绕RLVR框架做系统实验,完成论文《A3PO: Adaptive Asymmetric Advantage Shaping for Reasoning Models》,提出A3PO方法。该方法将训练重点转向关键决策点,让推理模型学习更可控。
MIT天才博士刚毕业,就被前OpenAI CTO抢走!年薪或300万起步
MIT天才博士肖光烜刚毕业就官宣加盟Thinking Machines,主攻大模型预训练。他履历耀眼,博士论文破解LLM三大难题,构建高效大模型框架。Thinking Machines薪资可观,平均年薪超OpenAI等公司。
美国AI一骑绝尘,中国平均落后7个月!Epoch AI新报告出炉
Epoch AI报告指出,中国AI模型进展平均落后美国7个月,最小4个月,最大14个月。这差距本质是「开源vs闭源」差距,中国领先大模型多开源,美国前沿模型均闭源。不过中国AI追赶速度稳定。
超棒Claude官方提示词:Anthropic发布Claude 4.x提示工程最佳实践
Anthropic发布Claude 4.x提示工程最佳实践,这些原则在顶尖大模型中一般通用。它强调精准指令驱动性能,构建记忆与状态管理机制,优化工具调用编排,激发高阶认知与专业输出,重塑代码美学与工程规范。
图灵奖大佬痛心:有人千万年薪,有人惨遭失业!25年全美疯狂裁员117万
2025年将尽,AI未带来美好,反致裁员失业。美国近5.5万岗位被AI取代,总裁员117万。图灵奖大佬Bengio、Anthropic CEO预警劳动力市场崩溃,人类需学习AI工具,从事创造性工作自救。
让大模型“吃一堑长一智”,南理工百度等提出模型记忆新方法
南京理工大学联合百度等提出新方法ViLoMem,构建视觉流+逻辑流的双流语义记忆,让模型“从错误中学习”。它能在多模态基准提升模型表现,强模型记忆还可迁移给小模型。
微软31年老员工被裁,六旬老将重新踏上求职路
新智元报道,微软31年老员工Mike Kostersitz被裁。近年AI重组其所在部门,致他命运改写。过去两年硅谷盛行裁员,AI浪潮下,有经验的技术人员首当其冲,像他这样的中层正被系统优化。
这,才是Vibe Coding的未来。
作者分享蚂蚁灵光更新,可搓小游戏,认为这是Vibe Coding未来。普通人能用上是其亮点,还举例扫地机器人、灵光开发三国人物关系等游戏,指出技术应隐藏自己,降低门槛。
规范驱动开发:瀑布模型回潮
规范驱动开发(SDD)重拾编码前写大量文档理念,虽为AI编程提供框架,但可能让敏捷性被Markdown文档掩埋。文章探讨为何迭代性自然语言方法更契合现代开发需求,指出SDD存在诸多不足。
ChatGPT「群聊」功能正式开启内测
OpenAI正式在部分地区试点ChatGPT群聊,覆盖移动端和网页端。该功能可用于生活娱乐、工作学习等场景,由GPT - 5.1 Auto模型驱动,操作简单,还考虑了隐私与控制。