「后训练范式」共找到 4414 篇相关文章
当 AI 能写代码修 bug,高考报计算机专业是“火坑”还是“新机遇” |深度对话 6 位专家
在 AI 浪潮下,编程范式变革,开发岗位结构改变。本文采访 6 位专家探讨高考生报计算机专业是否值得,还分析适合人群、专业核心技能重要性变化等,为考生提供多维度参考。
给大模型装上「思维分段引擎」:浙大InftyThink解锁无限深度推理
如今大模型长上下文推理面临计算成本高、推理易中断问题。浙大联合北大团队提出InftyThink新范式,将传统推理拆成短片段并总结,突破推理长度限制,在多基座模型实验中表现优异。
一码难求的 Dia 浏览器,有了新进展
Dia 浏览器处于 Alpha 内测,需邀请码体验。测试反馈超预期,将打磨细节后发布。其优势是使用 AI 时能方便代入上下文信息,Chat 交互将成主流,Arc 部分功能会融合进 Dia。
60000小时炼出新开源VLA!20多种机器人都能用
蚂蚁灵波发布开源VLA模型LingBot-VLA 2.0,用60000小时预训练数据“喂”出。它支持20多种机器人构型,融合LingBot-Depth提升空间理解,还学会预测未来,在GM - 100评测表现佳。
Anthropic 最新播客:如何打造下一代 Claude
Anthropic的Alex Albert上播客揭秘Claude产研流程,涵盖模型规划、用Claude处理反馈、记忆“做梦”机制、性格训练等,还谈及AI对PM工作方式的重塑,以及单向门决策框架等内容。
GitHub 如何用 AI 重构反馈处理机制
GitHub 引入由 AI 驱动的工作流,将无障碍反馈转化为工程工作。系统基于 GitHub Actions、Copilot 和 Models APIs 构建,集中管理报告、分析合规性、协调问题解决。采用后问题解决比例提升,时间下降。
给大模型「持续注入新知识」,北航CASE框架:编辑千次不失忆,额外参数不到1MB丨WWW'26
北航团队提出CASE框架解决大语言模型持续吸收新知识难题。该框架给编辑“算分”、调“关键神经元”,破解核心痛点。实验显示,1000次编辑后准确率提升近10%,额外参数不到1MB。
筹备三周,我们办下了第一场环球黑客松
2025年观猹平台创业,发现黑客松参与者需求,于是发起环球黑客松。1月16日杭州首站开启,筹备艰难但收获好评。活动趣事多,还公布各赛道获奖团队,后续会改进不足,期待下一站。
MIT天才博士刚毕业,就被前OpenAI CTO抢走!年薪或300万起步
MIT天才博士肖光烜刚毕业就官宣加盟Thinking Machines,主攻大模型预训练。他履历耀眼,博士论文破解LLM三大难题,构建高效大模型框架。Thinking Machines薪资可观,平均年薪超OpenAI等公司。
连肝36小时不睡!00后天才工程师,瘫坐特斯拉靠FSD保命
xAI工程师Parsa Tajik连续工作36小时后瘫坐特斯拉发X平台,同事纷纷叫好,马斯克也回应。xAI秋天忙碌,此前有裁员等情况。Tajik回应网友担忧,称拼车靠FSD安全回家。