「训练可用度」共找到 5694 篇相关文章
博士80小时熬夜改代码,Codex 2小时交卷!科研奇点来了
近日,Agentic AI工程师Dan McAteer实验发现,OpenAI Codex的Goal Mode完成机械可解释性研究任务,效率比博士高40倍。Codex /goal模式能自主循环,契合科研流程。此外,递归自我改进证据涌现,AGI或早已实现。
谷歌的DeepSeek时刻:LLM推理加速被干到了8倍
谷歌TurboQuant论文介绍量化算法,能为大语言模型和向量搜索引擎大规模压缩。可将大语言模型KV缓存内存减至少6倍、加速达8倍且精度零损失,还介绍其工作原理及实验结果。
VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景
上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。
Skills的最正确用法,是将整个Github压缩成你自己的超级技能库。
文章指出重复造轮子不可取,Skills可将Github开源项目封装成技能库。以FFmpeg、yt - dlp等为例,介绍封装流程,还提及多场景应用,如视频下载、格式转换等,让普通人能利用开源成果。
马斯克点火全球最大超算,首个1GW狂飙奇点!6万亿Grok 5在训
马斯克官宣全球首个吉瓦级超算Colossus 2上线,狂堆55万块GPU,目标百万。下一代Grok 5已在训练,6万亿参数将引爆智能奇点。同时,全球AI巨头掀起算力军备赛,但美国面临电力短缺难题。
首个完整开源的生成式推荐框架MiniOneRec,轻量复现工业级OneRec!
中科大LDS实验室与Alpha Lab团队联合开源MiniOneRec,是生成式推荐首个完整端到端开源框架。它验证生成式推荐Scaling Law,可轻量复现OneRec,提供一站式训练与研究平台,技术优势明显。
刚刚,LeCun团队开源首款代码世界模型!能像程序员一样思考的LLM来了
Meta官宣发布代码世界模型CWM,将世界模型引入代码生成任务。它基于编程和世界建模数据训练,能模拟程序执行与交互。在编程基准测试中表现不错,算是Meta的概念验证,目前可看作Demo。
快手Klear-Reasoner登顶8B模型榜首,GPPO算法双效强化稳定性与探索能力!
快手Klear团队推出Klear-Reasoner模型,基于Qwen3 - 8B - Base打造,在多基准测试达同规模SOTA。其核心GPPO算法能强化稳定性与探索能力,团队还对训练流程多环节深入分析,给出优化策略。
OpenAI刚刚发布GPT-5,免费使用、疯狂屠榜,一夜改写AI历史
今天凌晨1点,OpenAI发布GPT - 5,采用内嵌式三位一体集成架构,有创新的实时决策路由机制。免费版ChatGPT可使用,有额度限制。测试显示其在多领域大幅超越前代,应用开发能力强,今日向部分用户推出。
ChatGPT化身生活操作系统:奥特曼预告下一代顶级AI
在旧金山AI初创学校对话中,奥特曼宣布OpenAI计划发布强大开源模型,可本地运行。还谈到模型成本下降、ChatGPT记忆功能,以及GPT - 5等集成模型愿景,甚至称高级订阅将免费送机器人。