「社交认知能力」共找到 3536 篇相关文章
ACL 2026 | OPeRA Dataset: LLM真的能模仿人类行为了吗?首次系统评估LLM的人类行为模拟能力
美国东北大学等机构研究者提出OPeRA数据集,采集真实用户在线购物行为,支持系统评测LLM个体化行为预测能力。实验显示当前主流LLM在模拟人类行为上表现有限,揭示其能力边界。
新DeepSeek R1代码能力直逼Claude 4!附生成任何优质网站的通用提示词
作者体验DeepSeek R1超8小时,发现其文本写作问题大幅修复,思维链推理改进,代码能力提升,前端审美直逼Claude 4。文章展示其前端能力,给出写前端网页提示词及设计逻辑,还探讨了其在复杂任务中的表现。
5Y News|Kimi发布并开源 K2.5 模型,带来全新视觉理解、代码和Agent集群能力
2025年1月27日,月之暗面发布并开源Kimi K2.5模型,它是迄今最智能全能的模型,在多任务有出色表现。支持多模态输入,具备新能力,还推出Kimi Code工具,集群能力也开启Beta测试。
AI产品能不能火,全看创始人会不会当“网红”?这届AI大佬不拼代码了,个个都是隐藏的社交媒体达人
今年,AI创业者热衷在小红书冷启动产品,创始人分享创业思考,团队招募伙伴,投资人找项目。AI产品成功离不开社交传播,如Lovable、Base44等。但传播不能牺牲产品质量和技术壁垒,创业公司应抓住时间差深耕场景。
科学家的超级合伙人来也!星河启智「大圣」让高能动性AI「入局」真实科研
星河启智平台推出超级科研合伙人「大圣」,它构建了多模态科学基础模型等智能体协作研发能力,具备认知、行动、记忆、验证四大能力,且引入可信安全机制,推动科研生产关系重排。
重新认识具身行业,从自变量的这封邀请函开始
具身智能行业存在评分、技能、样品、商业四大‘气泡’,即认知偏差。自变量机器人将在发布会上戳破‘气泡’,打破认知差,重建评价标准。行业‘拐点时刻’需大脑能力突破、真实场景稳定运行、跑通ROI闭环。
多模态大模型,真的「懂」世界吗?——揭秘 MLLM 的核心知识缺陷
ICML 2025高分论文揭示MLLM核心认知盲区。研究发现主流MLLM缺乏核心认知能力,且不能靠规模扩展自然习得。作者构建测评体系CoreCognition,提出干预测试方法Concept Hacking,还给出关键发现与启示。
AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型
威斯康星大学麦迪逊分校联合清华大学的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,让AI“读懂人心”。其框架分三阶段,还有动态社交记忆,在多基准测试表现出色。
半年复盘,AI迎来预训练后的新瓶颈。
2025年上半年AI领域发展加速,编码和多模态能力提升。但模型在综合能力上遇到第二轮瓶颈,编码能力强时通用认知能力‘拉胯’,或与RL阶段使用编程数据有关,红杉新基准或推动模型均衡发展。
ChatGPT开始搞社交了
谷歌狂放大招,ChatGPT更新群聊功能,与微信、QQ群聊神似,还能让聊天机器人判断群气氛决定发言。不久前奥特曼称不做社交,此次更新被指仓促,未直击痛点、缺乏技术突破。