「效率模式」共找到 2054 篇相关文章
35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源
5月15日上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,尺寸小、科学能力强,在多方面有突破。其深化与昇腾算力生态协同,探索‘通专融合’,科学及智能体能力升级,还优化训推效率。
Kimi新架构让马斯克叹服!17岁高中生作者一战成名
17岁高中生陈广宇作为共同一作的论文提出Attention Residuals技术,将注意力机制“旋转90度”。该技术可让模型“回头看”,经Kimi Linear 48B大模型验证,训练效率提升25%,推理延迟增加不到2%。
00后黑客落网!曾运营大型僵尸网络,频繁攻击腾讯游戏、DeepSeek、X平台
活跃多年的高危DDoS僵尸网络‘RapperBot’被取缔,主谋22岁美国男子Ethan Faulds被捕。该网络曾攻击腾讯游戏、DeepSeek、X平台等。文中介绍其家族情况、盈利模式,还提及腾讯宙斯盾系统及防护建议。
突发!Qwen更新模型,全面超越kimi k2,强的离谱,主打Agent
Qwen小更新非推理模型性能强劲,各项指标超kimi k2,与Claude opus 4持平,Agent能力亮眼。Qwen团队告别混合思维模式,新模型上线,独立训练两模型,新版本多方面提升,团队称还有大招。
OpenAI o1核心大佬离职后首次演讲!AI智能体=人力+代码「无限杠杆」
OpenAI研究员Hyung Won Chung离职后发声,认为AI是人类历史上最强大杠杆,结合人力与科技优势。它能提升个人学习效率,智能体作为复合杠杆让小团队创造大价值,还能加速社会科学进步。
0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26
大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学与阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。
北大联合Llama-Factory推出DataFlex:工业级数据动态训练系统
北大张文涛教授、鄂维南院士团队联合多机构推出大模型数据中心动态训练框架DataFlex。它是统一训练基础设施,纳入三类核心能力,解决底层系统问题,在效率和效果上有提升,受社区认可。
构建 Agent Native 软件的完整技术指南
Dan Shipper 和 Claude 联合撰写构建 Agent 原生软件技术指南,总结如何重新思考软件架构,让 Agent 成软件一等公民。指南源于实战,介绍构建原则、方法、执行模式等,还提及产品影响、移动端挑战及应对。
云栖大会演讲实录:Qoder 产品背后的思考与未来发展
这是云栖大会上关于 Qoder 产品的演讲实录。Qoder 是阿里推出的 Agentic 编程平台,上线一月收获数十万用户。介绍了 AI Coding 三阶段,阐述 Qoder 定位、功能模式、技术优势,展望 AI Coding 未来。
AI真的需要「像人类」那样思考吗?AlphaOne揭示属于大模型的「思考之道」
近年大模型在推理任务有进展,但缺乏推理节奏调控能力。伊利诺伊大学厄巴纳 - 香槟分校和加州大学伯克利分校研究提出 AlphaOne 框架,引入 α - moment 实现无需训练的推理调控,实验显示其能提升准确率和效率。