「模型训练难题」共找到 8796 篇相关文章
DeepSeek V4 借实习生获奖论文“起飞”?梁文峰剑指上下文:处理速度提 10 倍、要“完美”准确率
ACL公布2025年获奖论文,中国作者比例超51%。DeepSeek梁文锋通讯、实习生袁境阳一作的论文获Best Paper奖。其提出NSA机制,实验显示性能优、准确率高、速度提升显著,成果或用于DeepSeek V4。
最新内幕!GPT-5没能取得技术突破,OpenAI核心投奔小扎另有隐情
据内幕消息,OpenAI面临数据瓶颈和技术难题,GPT - 4.5未达预期,GPT - 5转向实用改进。同时,公司存在技术转化问题、内部关系紧张等挑战,还在与微软谈判,也在为IPO做准备。
科学能力太强,这个多模态推理「六边形战士」被严重低估!Intern-S1开源登顶
7月26日,上海AI实验室发布并开源「书生」科学多模态大模型Intern-S1,其多模态能力全球开源第一,文本能力比肩一流,科学能力国际领先。它开创「通专融合」新范式,重构科研生产力,引发国际关注。
字节跳动刚把自己招牌AI Agent开源了,可商用、超6000颗星
字节跳动招牌AI Agent扣子(Coze)开源且支持商用。它是开发平台,提供大模型、工具与开发模式,可视化一站式开发,有上百种模版,还介绍了无代码开发客服智能体的步骤及功能。
刷新无监督异常检测上限!首提「匹配代价滤波for异常检测」范式 | ICML'25
新智元报道,东北大学等团队在ICML 2025提出CostFilter-AD,将「匹配代价体滤波」引入无监督异常检测,构建异常代价体并滤波,无需缺陷样本训练,可作插件提升现有系统,精准检测微小缺陷。
GuardAgent:首个专门为LLM agent提供安全Guardrail 的守卫型agent
近年LLM从对话工具变为可自主执行任务的agent,但带来安全隐私挑战。传统安全监护对其力不从心,为此学者发布GuardAgent,它守卫agent,具通用性、精确判断和免训练部署优势,实验表现佳。
AI教父Hinton暴论:AI永生之日,全人类变烤面包倒计时!
在Gitex Europe开幕日,「AI教父」Hinton接受专访,表达对AI发展的看法。他认为AI可深刻改变多领域,未来十年有望在数学领域超越人类,也指出AI能耗问题,担心人类触及能源极限,还强调AI可能灭绝人类,呼吁政府监管。
看遍奥斯卡后,VLM达到电影摄影理解新SOTA|上海AI Lab开源
上海人工智能实验室等推出ShotBench、ShotVL及ShotQA,ShotBench含超3.5k问答对,ShotQA约7万个问答对。ShotVL在ShotBench评测中表现出色,3B参数的ShotVL-3B增益达19.0%,超越GPT - 4o等。
AI Agent做PPT卷疯了,最强选手被挖掘出来了
2025年是AI Agent元年,做PPT成成果显著领域。Agent能自主完成PPT全流程,解决此前导出编辑难题。文章对比GenSpark、天工Agent等产品在不同场景做PPT的表现,为用户选择提供参考。
重塑AI记忆边界:MemOS开源!时序推理较OpenAI提升159%
近日,记忆张量等多家团队发布面向大模型的工业级记忆操作系统MemOS。它借鉴传统操作系统架构,实现AI记忆结构化管理,性能超OpenAI等方案,未来将成立社区、推进应用及持续迭代。