「00后团队」共找到 5053 篇相关文章
微软 & UT Dallas 联手揭秘:从 SFT 到 RL 的进阶之路
微软与 UT Dallas 合作论文揭秘大模型做漏洞检测从 SFT 到 RL 的后训练流程,构建 C/C++ 漏洞数据集跑通全流程,总结六大‘避坑’指南,还开源整套框架、数据集和模型。
32B逆袭GPT-5.2:首个端到端GPU编程智能体框架StitchCUDA问世
现有LLM自动化CUDA方法难处理端到端GPU程序,StitchCUDA提出多智能体框架+基于Rubric Reward的Agentic RL方案,分解任务、优化训练,在实验中成功率和加速比远超其他方法,解决Reward Hacking问题。
OpenAI连夜爆出GPT-5.4! 紧急上新GPT-5.3反击谷歌, AI爹味治好了
谷歌DeepMind推出Gemini 3.1 Flash - Lite不到2小时,OpenAI上线GPT - 5.3 Instant,不卷跑分,专治「聊天翻车」,幻觉率降27%,写作能力提升,还剧透GPT - 5.4更快到来。
光年之外居然做了能用Skills的AI浏览器:超实用实用案例+现成脚本
光年之外团队推出 Tabbit 浏览器,填补国内空白,有对话、妙招等 5 大核心功能。文章用5个案例展示其便捷性,如一键成稿、旅行规划等,还能解决收藏难题、增强网页功能,适配国内网站。
马斯克急了,直播回应一切!xAI全新阵容首曝光,华人联创仅剩一人
马斯克召开全员大会回应xAI高层变动,官宣合并后全新阵容。他还介绍了xAI四大核心板块,强调其发展成果,提及编程变革,宣布X平台开源等,更规划在月球建AI工厂。
逆天!Mata用13个参数26字节让模型正确率从76%飙升至91%
Meta等机构研究人员发布TinyLoRA极致微调技术,配合强化学习,能在几乎不改变大模型原有结构下,用极少数参数激发其推理能力。该技术在数学推理上表现出色,还探索了参数共享策略和存储精度问题。
Anthropic 新研究:AI出错是“热混乱”
Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。
谷歌给「AI解数学题」神话降温:能摘低垂果实,但过程依然痛苦
谷歌用Gemini对700个Erdős猜想做攻关实验,推进13个问题。但他们指出,这并不意味着AI能自动做数学研究,其背后核验等成本远超想象,还需警惕‘潜意识抄袭’。
蚂蚁发布全球首个视频-动作世界模型,开源即刷新世界纪录
从Sora惊艳亮相到谷歌开放Genie 3线上体验,世界模型从概念走向交互世界。蚂蚁旗下蚂蚁灵波开源全球首个视频 - 动作世界模型LingBot - VA,可驱动机器人完成复杂操作,解决长时漂移等问题,还提出工程化解法。
100k Star,他们给Clawdbot升级了超级记忆
Clawdbot项目突破100k,后改名moltbot。其原记忆是静态的,此次升级为超级/动态记忆,构建三层记忆系统,让理解力自我更新。还集成Supermemory,有自动回忆等功能,文章给出实施指南。