中数睿智」共找到 2931 篇相关文章

算法论文8

两个LLM互相对线,推理能力起飞:康奈尔团队发布大模型版类GAN训练法

康奈尔大学团队提出面向大语言模型的类GAN训练框架PasoDoble,通过对抗训练两模型提升推理能力,不依赖外部监督,在多模型实验显著提升学基准表现,不过在部分领域外任务有局限。

机器之心
产品应用7

从衣服到饰品:OmniTry 实现珠宝、包袋等多类可穿戴物品的虚拟试穿

Kunbyte提出OmniTry,将VTON从服装扩展到任意可穿戴物品,采用无掩码设定。它经两阶段处理流程训练,在12种常见物品类别评估表现优,有扩展潜力,但也存在训练据类别限制等局限。

带你学AI
算法论文8

大模型也需要自我反思,上海AI Lab合成“错题本”让大模型学成绩提升13.3%

上海AI Lab提出LEMMA方法,构建“错误 - 反思 - 修正”据,让大模型从错误学习。通过教师模型定向制造“学生会犯的错”构造据,实验显示在Llama3 - 8B上学解题准确率提升13.3%。

量子位
新闻资讯7

实证研究:AI杀猪盘比人类更强,已上岗缅甸

最近一项研究显示,在杀猪盘情感博弈,AI比人类骗子更有耐心,更易赢信任。研究人员做了AI与人类诈骗对比实验,结果显示大家更相信AI。如今AI已进入诈骗园区,虽未全面替代人类,但诈骗或更隐蔽高效。

量子位
开源动态8

给机器人一个会预测未来的Critic,VLA强化学习直接起飞

OpenMOSS团队开源的World Critic Model(WCM),解决了视觉 - 语言 - 动作模型强化学习(VLA - RL)批评家模型(Critic Model)仅依赖单帧观测打分的问题。WCM让Critic学习预测执行动作后的潜在状态,代码等全开源,验证效果显著。

机器之心
产品应用8

刚刚,Claude 5.1 发布!全球最强模型来了

Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1面向普通用户等,Mythos 5.1面向高风险领域伙伴。Fable 5.1性能优、价格低,在多测试表现提升,还能用于科研,且安全防护机制升级。

机器之心
产品应用8

别让米其林主厨削土豆!英伟达用「小脑指挥大脑」,重构AGI生产力

英伟达推出8B模型Orchestrator,通过组合工具降本增效。在HLE等测试超越GPT - 5,成本仅为其30%左右。它还能泛化到未见工具,具有可定制调度能力,标志着复合AI新范式的兴起。

新智元
开源动态8

一句话搞定后端?揭秘被 52.1k 开发者选择的 PocketBase:真能让你 0 运维快速上线产品吗?

PocketBase是“把后端打包成一个文件”的开源项目,既可以作为独立的轻量后端服务直接运行,也能作为Go库嵌入到应用。它能解决团队做MVP等遇到的痛点,有诸多核心功能和技术优势。

小华同学ai
新闻资讯7

通用型产品增长停滞,垂直赛道成市场新解法丨季度AI 100据解读

新一季度「AI 100」双榜单出炉,量子位智库分析1000+款AI产品。Web端总访问量和MAU增长停滞,头部下滑;APP端腰部产品表现佳。Agent产品用户增长亮眼,未来桌面端和Web端定位将区分。

量子位
开源动态8

登顶!快手发布开源编程模型,720亿参,创下编程能力新纪录

快手发布开源编程模型KAT-Dev-72B-Exp,在SWE-Bench Verified测试登顶开源代码模型,与闭源GPT - 5成绩相近。该模型基于自研框架,有架构创新,还集成多种软件工程能力,是构建编程智能体的有力工具。

AIGC开放社区