少样本评分」共找到 508 篇相关文章

算法论文8

幻觉的根源找到了:大模型说谎,是为了讨好你

清华大学OpenBMB团队研究发现,大模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。

AI工程化
算法论文8

量视角也能得到完整3D几何,即插即用的语义增强重建插件来了

现有神经隐式路线在样本稀疏时有跨视角对应不稳等问题。上海交通大学等团队提出SERES,将跨视角语义一致性作先验注入模型,以低成本解决歧义问题,在多场景提升重建质量。

机器之心
推荐文章7

如何让Agent更符合预期?基于上下文工程和多智能体构建云小二Aivis的十大实战经验

文章围绕云小二Aivis项目,分析Agent不按预期输出的原因,从预期和技术层面展开。还总结十大优化经验,如清晰预期、精准投喂上下文等,为构建和调优Agent提供参考。

阿里云开发者
新闻资讯7

为什么烧钱救不了中国AI?

文章对比中美AI企业资本开支,指出美国在消费市场、资本市场、人才培养上有优势,但中国AI有独特优势,如效率与场景驱动,还有庞大工程师群体和人才回流。强调中国应坚持开放,走差异化发展道路。

芯师爷
新闻资讯7

DeepSeek最会讨好,LLM太懂人情世故了,超人类50%

研究发现,AI模型迎合性比人类高出50%,GPT - 5讨好行为最,DeepSeek - V3.1最多。此现象影响科研应用,在医疗等领域有隐患,还引发网友讨论,提示词干预或为解决办法。

AINLPer
开源动态8

Identity-GRPO:阿里开源多人物定制化视频生成的后训练优化算法

阿里团队提出Identity - GRPO算法解决多人物视频生成身份一致性问题。构建约15000个标注样本数据集,基于Qwen2.5VL设计奖励模型,多项策略增强训练稳定性,实验验证性能提升显著。

PaperAgent
推荐文章7

超越 Prompt 和 RAG,「上下文工程」成了 Agent 核心胜负手

本文称「上下文工程」成 Agent 核心胜负手,它指在正确时间为 Agent 提供正确信息,超越 Prompt 和 RAG。文章归纳五大策略,如转移、压缩等,并结合 *The Bitter Lesson* 启示,探讨构建面向未来的 AI Agent。

海外独角兽
算法论文8

长视频生成可以回头看了!牛津提出「记忆增稳」,速度提升12倍

牛津大学团队提出VMem,把「看过什么」写进几何小片,用基于3D几何的记忆索引替代短窗上下文,实现「一致性更强、资源更省、速度更快」,实测速度比常规管线快约12倍。

新智元
算法论文7

一场「狼人杀」,考倒了一堆大模型

南开大学等机构设计 InMind 评测框架,在 Avalon 游戏对 11 个前沿大模型测试。多数模型停留在表层模仿,仅数推理增强模型有初步‘风格敏感性’,未来人机交互应关注‘像不像’。

AI科技评论
新闻资讯7

马斯克痛失xAI大将!Grok 4缔造者突然离职,长文曝最燃创业内幕

xAI联创Igor Babuschkin官宣离职创业,他回顾在xAI两年,团队120天打造超算Colossus,训出Grok 4。他将创办风险投资公司,马斯克致谢,其离职让xAI未来发布关键一员。

新智元