「设计与代码」共找到 8399 篇相关文章

新闻资讯8

别跟LLM太交心!斯坦福新研究:AI不能完全取代人类心理治疗师

斯坦福大学研究团队测试流行AI模型及商业化AI治疗平台,发现AI治疗师存在根本缺陷与潜在危险,如歧视回应、无法危机干预、谄媚等,但也认可其在心理健康方面的辅助用途。

量子位
算法论文8

一篇95页最新80种Deep Research系统全面综述

浙大研究深度研究系统领域,分析自2023年以来80多个实现,提出4维度分层分类法,全面剖析4种实现架构,如单体、流水线、多智能体和混合架构,并阐述各维度演变与进步。

CourseAI
新闻资讯8

新紫光集团三周年:智变跃升,交出硬核答卷

2025年7月11日新紫光集团完成战略重整三周年,交出硬核答卷,连续三年营收超千亿,专利增加。其聚焦智能科技主业,通过战略布局、技术攻坚、生态协同实现发展,未来将持续求新求变,深化合作。

芯师爷
开源动态8

MemOS:一种用于 AI 应用的记忆操作系统

大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统化三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。

PaperAgent
算法论文8

关键突破:理论验证了 RL for LLM 路线的可行性

传统RLHF依赖人工标注偏好数据训练奖励模型,成本高且难扩展。本文发现任何通过Next - token预测训练的LLM内部隐含通用奖励模型,从理论和实验证明其可高效实现模型对齐。

深度学习自然语言处理
新闻资讯7

更长的推理链反而导致更多幻觉,MLLMs 幻觉解法仅「抄作业」还不够?摘要

近日,斯坦福等校学者发现,更长推理链会让 MLLMs 产生更强幻觉。MLLMs 幻觉不仅涉及语言偏差,还有跨模态语义失配。主流多模态架构在结构设计和训练机制上的潜在失衡,是幻觉频发的主因。

机器之心
推荐文章7

如何判断 AI 将优先自动化哪些任务?

思考AI优先自动化哪些任务,可从‘描述 - 执行鸿沟’视角出发。‘描述 - 执行鸿沟’大的任务是自动化沃土,反之自动化价值有限且创建训练数据难,它与‘判别器 - 生成器鸿沟’相似又不同。

宝玉AI
新闻资讯7

离开百川去创业!8 个人用 2 个多月肝出一款热门 Agent 产品,创始人:Agent 技术有些玄学

前百川工具链负责人徐文健离开百川后创业,和冯雷创立火星电波,推出AI播客产品ListenHub。团队搭建重品质,产品研发仅用两月多,虽获用户认可,但也面临质疑,公司计划出海,徐文健认为企业核心是组织和理念。

AI前线
新闻资讯7

马斯克Grok 4逆天跑分泄露,「人类最后考试」豪取45%全场第一!

Grok 4跑分提前泄露,在「人类最后考试」中得分高达45%,远超Gemini与Claude,成为当前测试中最强模型之一。马斯克表示Grok 4以「第一性原理」构建推理机制,有望改写LLM格局。

新智元
推荐文章8

吴恩达老师分享的做 MVP(最简可行产品,minimum viable product) 的技巧

吴恩达分享做MVP技巧,建议时间有限时缩减项目范围,如一小时内借助代码助手做小部分。他以做虚拟观众模拟器为例,说明此方法能推动项目、收集反馈,让创意快速落地。

宝玉AI