「推理框架开发」共找到 4677 篇相关文章
19K star 霸榜,下一代的浏览器自动化神器!
做爬虫或Web自动化测试常因网页结构变动需重写脚本。Github上超火的Skyvern项目是基于浏览器的自动化代理,不依赖XPath或CSS选择器,用视觉识别结合大模型推理完成任务,已获19k+ star。
打破碎片化瓶颈!浙大&哈佛开源UniGeo,高保真相机可控编辑
当前主流相机可控图像编辑基于图像扩散模型,应对连续相机运动易出现问题。近日,浙大联合哈佛发布UniGeo框架,在三核心层面注入统一几何引导,克服结构退化,提升视觉质量与跨视角一致性。
OpenClaw安全有救了!不改内核、无视AI内部逻辑,数学级枷锁驯服暴走智能体
OpenClaw等智能体能力强大但有安全黑洞,南方科技大学和香港科技大学团队推出ClawLess框架,从底层系统调用源头扼杀智能体出格行为,通过形式化验证、物理隔离、动态验证等手段保障安全。
从实践到原则:为 AI Agent 构建的 Harness Engineering 落地与探索
生成式 AI 进入软件开发核心流程,但 AI 写代码速度超团队控复杂度能力。问题不在模型,而在软件工程系统。Harness Engineering 试图解决此问题,从三层面重新设计工程系统,已有公司实践。
曾对AI嗤之以鼻,如今2周生成7万行代码:Rust大佬与Claude联手打造新语言Rue
2025年,Rust社区早期核心人物Steve Klabnik心态转变,开始借助Claude编写代码。他重启念头设计新语言Rue,探索编程语言‘中间地带’,两周生成约7万行代码,开发中人与AI分工明确。
7篇顶会NeurIPS 2025最佳论文都说了什么?
NeurIPS 2025七篇获奖论文揭示大模型思维同质化、推理能力虚幻边界等隐忧,也在注意力机制、神经扩展定律等方面取得物理学层面突破,为AI建立更严谨科学地基。
24个月,从写第一行代码到破产:一位架构师在47个“死亡”项目里,看到的共同陷阱
架构顾问审阅47家初创公司代码库,发现它们因产品无法扩展、技术债积累走向停滞。提出花两周做架构可避免问题,还指出AI虽降低开发门槛,却加速技术债积累。
Transformer祖传设计遭暴击,COLM顶会三篇论文发难
COLM 2026上,三篇论文对Transformer关键技术发难。《Cracks in the Foundation》指出长上下文架构选择影响大;《Lost in Backpropagation》揭示输出投影层信息损耗严重;《When Fewer Layers Break More Chains》表明层剪枝影响长链推理。
泪崩!!!完啦,完啦 AI 编程,4k Star MonkeyCode!!!
现在很多AI编程工具,只让Agent“写出代码”。而MonkeyCode把AI编程任务接入完整链路,是面向专业研发团队的开源AI开发平台,本文介绍其特点、适用场景及注意事项。
如何训练VLA?丰田研究院发布史上最大实验规模「保姆级」教程
丰田研究院和清华大学发布教程,用大量数据训练89个策略模型并验证。聚焦Co - training,研究五大模态、三种策略,对比不同架构,揭示有效和无效模态,还探讨CoT推理及多方面实验。