「设计效率」共找到 2392 篇相关文章
炸裂提速30倍!Meta提出REFRAF,无需改动模型,让RAG告别冗余与等待
近年来,RAG任务在提升模型回答质量的同时带来性能代价,Meta等团队合作提出REFRAG框架。它将无关段落压缩,引入强化学习选关键段落,实现高达30.85倍的TTFT加速,且无需改模型结构,实用性强。
比 996 还狠!让面试者8小时复刻出自家Devin,创始人直言:受不了高强度就别来
Cognition 公司面试要求面试者 8 小时复刻自家 Devin,其 CEO Scott Wu 直言受不了高强度就别来。文章还介绍了他的成长经历、创业看法,以及 Devin 特点、业务指标、未来格局等,也提及收购 Windsurf 事宜。
教AI「择偶生娃」,复刻自然演化!上交校友提名最佳论文
Sakana AI受自然演化启发提出全新模型融合进化方法M2N2,引入‘择偶机制’让AI‘竞争、择偶、繁衍’。此研究获GECCO 2025最佳论文提名,M2N2表现优于其他算法,还避免‘灾难性遗忘’。
Deepseek 正式发布 V3.1:混合推理,Agent能力大幅提高,token消耗减半
Deepseek正式发布Deepseek V3.1,采用混合推理,支持双模式切换,上下文扩展到128k,API支持Claude Code调用。工具与Agent能力提升,思考效率更高,token消耗减半,官方渠道全面升级,9月6号起调整价格。
思维链可无限延伸了,MIT等打破大模型上下文天花板
MIT等机构提出新架构Thread Inference Model(TIM),配合专用推理引擎TIMRUN,把推理过程变为树状递归子任务结构并修剪子任务,让模型突破输出窗口限制实现长程推理,实验验证了其性能。
Meta华人天才毕树超「叛逃」预言:OpenAI未竟交互革命,暗藏万亿赛道
Meta科学家毕树超在演讲中揭秘AI进化真突破,认为更好更快造数据是关键。他指出AI原生交互领域若有新突破,或催生万亿级公司,语音和视觉将成重要部分,还分享了AI进化时间线及面临的问题和未来图景。
传言:华为版 DeepSeek R2 本月发布
据 Huawei Central 报道,DeepSeek R2 可能本月 15 至 30 日发布,运行在华为 Ascend 910B 集群,硬件利用率 82%,算力 512 PetaFLOPS FP16,效率达 A100 的 91%,将与 ChatGPT 5 竞争,但消息未证实。
AI开始学会合作?!实测4大多Agent体=10个打工人
Agent热潮进入多智能体时代,多款产品涌现。鲸哥测评了它们在商业计划、运营设计等四大场景表现,总结各产品亮点与不足,指出多Agent正推动大模型向“协作式智能群体”演进。
硬核拆解大模型,从 DeepSeek-V3 到 Kimi K2 ,一文看懂 LLM 主流架构
本文详细列举 8 个主流大语言模型,硬核拆解架构设计与革新思路,介绍架构演进趋势。如 DeepSeek-V3 的 MLA 与 MoE 技术,OLMo 2 的归一化策略,Gemma 3 的滑动窗口注意力机制等。
长得这么“乖”的人形机器人,第一次见
北京朝阳,傅利叶发布全尺寸人形机器人Care-bot GR-3,外观采用莫兰迪暖调配色等设计,有亲和力。它配备全感交互系统,能实现多种拟人行走姿态,未来将拓展至辅助陪护场景。