认知几何学」共找到 742 篇相关文章

算法论文7

一文解读 LLM Posting-Train技术

文章解读了大语言模型后训练(Post-training)技术,介绍其核心价值,从微调、强化习、测试时拓展三方面展开,分析现有技术瓶颈,指出前沿研究方向,还给出实践指南和工具链推荐。

海边的拾遗者
新闻资讯7

Claude 4如何思考?资深研究员回应:RLHF范式已过,RLVR已在编程/数得到验证

Anthropic两位研究员在博客采访中透露Claude 4思考细节。提到可验证奖励强化习RLVR在编程和数领域获证明,探讨了RL扩展、模型自我意识等,还为大生给出AI领域建议。

量子位
新闻资讯8

对话西湖大刘癸庚:从拓扑光子到太赫兹芯片,他想做连接AI大脑与身体的人

本文是对西湖大刘癸庚的访谈。他在拓扑光子研究成果丰硕,如三维光子陈绝缘体、光子轴子绝缘体的研究。如今专注太赫兹芯片与通信,想构建连接‘AI 大脑’与‘AI 身体’的链路。

DeepTech深科技
推荐文章7

分享一些可以让AI使用更丝滑的小技巧

作者起初用AI不顺手,经研究摸索发现是指令有误。分享沟通技巧,如给身份、给参考风格、用“说人话”“举例子”,还可当头脑风暴搭子,强调清晰指令能助自我认知

每日豆瓣
算法论文8

换个地面/身体,机器人策略就失灵?让扩散策略读懂「动力」| ICML'26

扩散策略成机器人控制热门路线,但真实世界动力多变,策略易失灵。UC Berkeley等联合提出DADP,训练统一策略,在零样本跨域控制任务表现强,尤其在OOD场景优势明显,还给出工程补充结果。

新智元
新闻资讯7

三分之一arXiv沦陷!CS论文65%被判「AI味」,数仅0.7%

一份unslop研究显示,过去一年arXiv计算机科领域65%新论文被检测器标红,但可能只是闻起来像AI。数论文仅0.7%,或因检测器只认文字。研究有局限性,真实用AI比例可能更高。

新智元
算法论文8

大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!

Qwen团队等最新研究打破传统认知,揭示‘对齐税’现象。提出置信解码策略,在多架构、评测集上表现出色,能绕过‘对齐税’,提升推理准确率,且工程开销低,为大模型发展提供新思路。

量子位
算法论文8

刚刚,DeepSeek陈德里与两个AI,合写了一篇论文

DeepSeek研究员陈德里与DeepSeek-V4-Pro、GPT - Image2合写论文《From Copilots to Colleagues: A Survey of Autonomous Research Agents》。文章是兴趣驱动的尝试,分析自主科研智能体,提出自主等级分类、架构模式分析及未解难题。

机器之心
新闻资讯7

机器人的“ChatGPT时刻”为何迟迟未来?

俄勒冈州立大教授乔纳森和前 Google X 高管汉斯探讨机器人有无“ChatGPT 时刻”。指出机器人领域难现单一突破,需工程实践、工具配合和数据积累,还从多方面分析了面临的问题。

DeepTech深科技
算法论文8

图像编辑模型不止生成:BIGAI&上交大提出EAR范式,系统测试其视觉规划能力

上海交通大联合北京通用人工智能研究院提出EAR范式,构建AMAZE基准,分析图像编辑模型视觉推理能力。研究发现模型零样本表现弱,扩散式模型更适合视觉规划,CoT效果不稳定等。

AI科技评论