「2D交互场景」共找到 3986 篇相关文章
火了!刚刚,李飞飞2篇最新文章发布!
AI圈近期被李飞飞两篇重磅文章刷屏,一篇阐述空间智能愿景,指出当前AI缺乏空间智能,其创办的World Labs提出世界模型;另一篇论文揭示当前视频理解基准自欺欺人,还提出新基准VSI - SUPER及预测性感知新范式。
2篇论文,最新上下文工程技术一次性讲透!
上下文工程技术持续火热,文章分享10月两篇相关论文。ACE让模型给自己写「战术板」,在多任务表现优;SA - ICL让LLM先搭框架再做题,在化学/物理准确率提升显著,还对二者做了横向对比。
18岁女孩做养老机器人,上线2天卖爆了
18岁女孩Audrey Lo和团队推出养老机器人Sam,上线两天订单多到网站崩溃。它能24小时监测老人安全、提供陪伴,还可辅助护理人员。Audrey Lo此前还有两次创业经历,这款产品戳中市场痛点。
Anthropic8张图,揭示Workflow & Agent的协作场景
文章借Anthropic的阐述,区分了Workflow与Agent概念。指出任务明确用Workflow,开放式问题用Agent,还介绍了构建blocks、workflows方法及Agent工作方式和实施原则。
近 2w Star,隐私优先,打工人新选择!
云端AI会议工具存数据泄露风险,Meetily项目主打100%本地处理,解决隐私短板。它是开源AI会议助手,能实时转录音频、区分说话人、生成摘要,数据不离开设备,在GitHub获近2万Star。
2篇最新Anthropic论文,揭开LLM对齐新范式
Anthropic在5月连发两篇研究,揭示LLM对齐训练新范式。指出单纯模仿正确行为不足以保证安全,需在预训练与对齐微调间插入教原理阶段。研究围绕Claude模型展开,有多项关键发现,MSM方法效果显著。
分享2篇最新Harness论文,一篇谷歌,一篇微软
在LLM Agent迅速发展的当下,如何为其设计合适的Harness成关键问题。本文分享微软M⋆和谷歌AutoHarness两篇论文,分别从记忆系统和动作约束维度提出自动化的Harness进化方法,并介绍了实验结果。
AgentIF-OneDay 发布,评估全场景长时复杂任务
红杉中国 xbench 发布 AgentIF - OneDay 评测体系,用于评估大模型解决复杂任务的能力。该体系从任务复杂度新视角出发,沿 Scaling Context 和 Scaling Domain 推进,构造了三类典型任务进行测评,揭示了主流 Agent 的能力边界。
半年赚2亿,400亿市值,它是又一个“寒武纪”?
高端光芯片长期被海外垄断,源杰科技在技术隐士张欣刚带领下实现突破。其25G激光器芯片通过验证,后多款芯片量产,2025年上半年业绩与股价双涨,市值超400亿,还布局美国生产基地。
AI PC,一场关于算力、场景与生态的远征
AI PC 市场竞争升温、格局重塑,本质是下一代计算入口争夺。英特尔通过硬件创新、生态共建等推动 AI PC 发展,在 2025 抖音商城秋上新秀展出相关产品,其酷睿 Ultra 处理器优势明显,市场呈多元竞逐态势。