「任务设计」共找到 3060 篇相关文章
真实科研水平集体不及格!全新基准SFE给主流多模态LLM来了波暴击
上海人工智能实验室AI4S团队推出SFE评测基准,首创三级评估体系,涵盖五大科学领域66项任务。评测显示主流MLLMs在高阶科学任务有挑战,不同模型、学科表现有差异,还构建了SciPrismaX平台推动AI科学评估生态发展。
是剧本杀来了?还是儿童剧本杀教育机会来了!
儿童剧本杀教育的兴起,不仅为孩子们提供了一种新颖的娱乐方式,也带来了教育的新机遇。它通过沉浸式体验,让孩子们在玩耍中学习历史,培养兴趣,同时满足了市场对创新教育内容的需求。
Anthropic推演2030年美国经济:AI时代,钱流向了有钱人
本文解读Anthropic最新AI影响经济研究报告,报告从任务层面建模,设置三种AI发展情景,推演2030年美国GDP、就业与收入分配的变化。
刚刚微软开源视频录制技能skill-recorder
微软开源视频录制技能 Skill Recorder,能将用户完成任务的过程转化为 AI 智能体可重复执行的技能。它捕获屏幕工作会话,用 GitHub Copilot CLI 重构操作,生成可复用内容,支持多平台。
Agent不是关键!人大AiScientist实现23小时、74轮长程记忆
中国人民大学团队打造的AiScientist,旨在解决长程机器学习研究工程的持续性难题。它通过File - as - Bus机制稳定保存项目状态,在多轮实验中表现出色,提升科研效率,推动AI真正接手科研流程。
马斯克:Optimus 将成为有史以来最大的产品,比第二大10倍!
马斯克演讲称Optimus将成有史以来最大产品,比第二大产品大10倍,还展示其家务能力。网友反应多样,有技术疑问、应用幻想,也有价格质疑,Tesla股东很兴奋,激起全网讨论。
比Sora更疯狂!英伟达AI让机器人「做梦」修炼,无师自通直接上岗
英伟达新研究项目DreamGen用视频生成模型让机器人在神经网络生成的「梦境世界」自主探索学习。它能让机器人掌握新动作、泛化到新环境,合成数据暴涨333倍,还引入DreamGen Bench用于视频生成基准。
还是你们会玩,2.9k Star OpenBiliClaw
OpenBiliClaw把浏览器扩展等拼成内容发现Agent,将内容推荐主导权交回用户。它汇总显式授权来源信号找内容,形成本地画像。介绍其架构层级、核心闭环,也提醒“本地优先”仍需做隐私检查。
再也不用盯着几十个终端窗口!Claude Code推出Agent视图,一屏管所有
Claude Code推出Agent视图功能,能让用户在一个界面统一管理所有Claude Code会话,改善了会话可视化和交互方式。用户可总览会话、不离开视图查看回复、随时切到后台,开发者也有多种典型用法。
让Agent真正“行动”起来,Agent Skill开发者大赛火热报名中!
人工智能下半场聚焦‘行动’,Agent Skill成关键桥梁。Agent Skill开发者大赛今日启动,由AIGC开放社区与算泥社区联合主办,设双赛道,有官方支持和丰厚奖励,报名通道已开启。