无监督去偏对齐」共找到 937 篇相关文章

算法论文8

Meta这两篇最新Agent Learning论文,有些意思!

分享Meta SuperLabs两篇Agent Learning论文,从‘如何低成本获得高质量经验’出发,形成技术链,为语言智能体进入‘规模化RL时代’提供路线图,还分析了Agent RL问题及两论文成果、对比。

PaperAgent
产品应用8

机器人IRON被质疑是“真人秀”?小鹏一镜到底:七年打磨的行走答案

当IRON机器人被质疑“真人扮演”,小鹏一镜到底展示其内部结构。团队耗时七年打磨,实现轻盈稳定,其动作拟真度高模糊人机边界,是成功演示与公关案例。

搜狐看展
开源动态7

Rust版本的DeepSeek-OCR来了,告别python原版的繁琐配置

网友用Rust重写DeepSeek - OCR推理栈,解决原版Python依赖复杂问题。此版本Python依赖,可离线运行,兼容OpenAI API,还支持苹果芯片Metal加速,介绍了技术实现、使用方法和场景。

AI工程化
新闻资讯7

他用一生证明AI没有意识!「中文屋」提出者逝世,享年93岁

2025年9月,Anthropic团队发现AI模型出现「主体错位」现象,而同一周哲学家约翰·塞尔去世,享年93岁。他一生证明AI只会模拟理解,提出「中文屋」思想实验,如今AI似有「意识」,而他却毁于性骚扰丑闻。

新智元
产品应用7

数据分析师,即将从工业领域“消失”?

2023年底Google裁撤数据科学家引发关注,AI+BI普及使岗位裁撤风潮蔓延至工业领域。2025年7月TDengine发布TDengine IDMP,主打“问智推”,有望带来数据消费范式革命,加速工业智能化转型。

InfoQ
新闻资讯7

英伟达回应了!没有后门、没有终止开关、没有监控软件

8月5日英伟达官方博客回应「H20后门」事件,首席安全官称芯片没后门,过去、现在和未来都不会有。其指出嵌入后门危害大,还以Clipper芯片为例说明预设后门会留隐患、摧毁信任。

新智元
新闻资讯8

Anthropic CEO最新采访:AGI一词毫意义、点名扎克伯格、谈开源、家庭……等八个非共识观点

Anthropic CEO Dario Amodei在采访中给出八个非共识观点。他认为AGI和ASI是空洞概念,年亏30亿美元是投资,开源作用被高估,还谈及公司应对挖角、竞争、市场定位等策略,展现独特领导风格。

AGI Hunt
推荐文章7

技术狂飙下的 AI Assistant,离真正的 Jarvis 还有几层窗户纸?

随着AI技术进入新阶段,LLM面临新天花板,市场呼唤从「会聊天」迈向「能行动」的下一代AI Assistant。文章从智能规划与调用等维度分析其发展挑战,介绍不同技术路径并分析优劣势。

机器之心
8

DeepMind夺得IMO官方「唯一」金牌,却成为OpenAI大型社死现场

谷歌DeepMind宣布其Gemini进阶版模型在IMO竞赛达金牌水平,解决五道超高难度试题,首次证明AI仅靠自然语言理解就能攻克复杂数学难题。其谨慎发布方式获赞誉,与OpenAI形成鲜明对比。

机器之心
新闻资讯7

一盘大棋!OpenAI「截胡」IMO金牌,奥特曼为GPT-5献上「核弹级」预热

OpenAI用全新通用推理模型拿下IMO金牌,抢了谷歌DeepMind的风头。此模型是融合新通用技术的推理LLM,在推理时间跨度和效率上有进步。奥特曼借此为GPT - 5预热,陶哲轩指出缺乏统一标准时对比AI表现意义。

新智元