「算法设计」共找到 1795 篇相关文章
三个方法让Cursor构建网站更加精美:Browser MCP 克隆 + 提示技巧 + 组件修改!(Bolt、Lovable)
文章介绍用Browser MCP克隆网站结构、结构化Prompt模板及UI组件修改三种方法,让Cursor构建网站更精美,还分享Lovable设计技巧、让AI网站变好看的方法及早期公司获客策略。
Claude一夜爆更自修bug,PR自己绿了!全球程序员:「摸鱼」正式合法
Claude Code上线「云端自动修复」功能,可自动跟进PR,排查问题、写代码并推送,解放开发者双手。同时,科研团队用其打造Claudini,迭代56次发现新型越狱算法,Claude Code还能自进化写代码。
刚刚!Kimi Linear横空出世,全新注意力架构:1M长文本解码速度飙升6.3倍,KV缓存砍掉75%
月之暗面推出全新注意力架构Kimi Linear,有望成下一代Agent LLM基石技术。它解决了LLMs处理长序列任务的瓶颈,性能超传统机制,还开源了核心代码。Kimi Linear的KDA模块提升了表达和硬件效率,实验表现佳。
揭示隐藏联系:RLHF/DPO即对比学习!
大型语言模型输出符合人类价值观是挑战,主流技术RLHF复杂、昂贵且不稳定,DPO简化流程但有训练崩溃问题。论文揭示RLHF/DPO即对比学习,提出MIO算法解决DPO崩溃,实验验证其性能优势。
张雪机车燃爆封神!国产2B语音模型重磅开源,全网听完都起鸡皮疙瘩
面壁智能联合多方开发的2B小模型VoxCPM 2于4月开源,支持30种语言与9大方言,能实现声音克隆、情绪控制、音色设计等功能。实测显示其能力出色,还提供全家桶级工具箱,采用独特技术路线。
港中文联手美团开源“视觉推理通才”!图像视频10类任务一网打尽
香港中文大学MMLab与美团研究团队开源OneThinker模型,它可覆盖图像与视频十类核心视觉任务,在31项测试中表现出色,还展现泛化能力。研究团队搭建数据集,并引入EMA - GRPO算法提升训练稳定性。
首次实现第一视角视频与人体动作同步生成!新框架攻克视角-动作对齐两大技术壁垒
新加坡国立大学等联合发布EgoTwin,首次实现第一视角视频与人体动作联合生成,攻克视角 - 动作对齐与因果耦合瓶颈。它基于扩散模型,通过三大创新设计解决核心难题,实验性能超基线,为多领域应用提供落地基座。
微软开源3大突破AI Agent模型,仅140亿参数超越DeepSeek-R1
微软研究院开源AI Agent推理模型rStar2-Agent,140亿参数在多测试超6710亿参数的DeepSeek-R1。其通过智能体强化学习,在训练基础、算法、流程上有三大突破,显著提升性能且降低算力成本。
Anthropic万字Skills教程,把Agent工程的核心武功秘籍说明白了
Anthropic官方发布33页Skills构建指南,详细介绍构建高效Skill的方法,涵盖基础概念、规划设计、测试迭代、分发共享等内容。还提及openai用codex agent做项目的经验,指出人类审查成瓶颈,引出渐进式披露的核心秘籍。
强化学习大本营新作:如何破解「学新忘旧」困局
阿尔伯塔大学强化学习团队提出FAME框架,解决持续强化学习“学新忘旧”问题。团队先定义基础概念,将知识整合写成优化问题,再受人类学习机制启发设计FAME,实验优势明显。研究还探讨持续学习的产业价值。