学院派」共找到 105 篇相关文章

产品应用7

刚刚,Claude Code 推出手机通知功能。被催着干活的打工人,从此不能再摸鱼……

Claude Code 新增手机推送通知功能,任务完成会主动 ping 手机,开启方式简单。它还支持桌面通知,与此前功能形成活、执行、汇报闭环,解决了人如何知晓 AI 完成任务的问题。

AGI Hunt
算法论文7

BeyondSWE:AI编程80分是真的强,还是考卷太简单?

前沿模型在SWE - bench Verified测试中得分超80%,但该测试像开卷填空。中国人民大学提出BeyondSWE重新设计评测,规模是前者18倍,模型得分全跌破45%。还提出SearchSWE框架,结果显示搜索与编码能力融合待提升。

PaperAgent
新闻资讯7

一等奖20万,大佬们出题,最硬核视频生成全球挑战赛开启!

首个AI视频生成全球挑战赛来袭,多位大佬发起,20万大奖待拿。大赛聚焦AI视频生成「一致性」挑战,设主赛道和创意赛道,分别面向技术和创作者,旨在推动视频生成技术发展。

新智元
新闻资讯7

硅谷顶级AI天才成「团宠」:布林请吃饭,奥特曼约打牌

天价薪酬、创始人亲自出马、私人飞机接送,为抢夺顶尖AI人才,硅谷大厂猛下血本。OpenAI、谷歌等公司不惜重金,争夺「超级明星研究员」,AI人才稀缺也迫使一些公司采取创意招聘策略。

新智元
产品应用7

两个95后华人,搞出硬件版Clawdbot,售价1700元

本文介绍硬件版OpenClaw——Distiller Alpha,其核心计算基于树莓CM5,集成多设备,能和Agent对话,可Vibe coding。量子位采访创始人叶天奇,探讨软硬一体Agent、OpenClaw优缺点、硬件创业等问题。

量子位
算法论文8

AgentAuditor: 让智能体安全评估器的精确度达到人类水平

LLM智能体进化为“行动”,但自主权带来安全问题。现有评估基准缺乏有效精准评估器,研究者推出AgentAuditor框架及ASSEBench基准,让LLM评估器精确度达人类水平,为构建可靠智能体提供工具。

机器之心
算法论文8

24小时、78轮实验、持续迭代,AiScientist自己把最优解一步一步逼出来了

中国人民大学高瓴人工智能学院的AiScientist挑战让AI持续推进研究工程。它采用“thin control over thick state”设计,通过分层编排和File - as - Bus等方式,在多任务上表现出色,为AI科研工程补上关键底座。

PaperAgent
新闻资讯7

Anthropic发布多Agent协作模式指南:5种架构与适用场景

当单个AI Agent无法完成任务时,多Agent系统就上了用场。Anthropic最新发布的指南给出了五种经过验证的模式,包括生成 - 验证模式、编排 - 子代理模式等,并介绍了适用场景和陷阱。

AI工程化
8

制造企业如何实现 AI 产品经理“能力复制”?|极客时间 AI 人才培养实践

在数智化转型中,企业 AI 培训常难以转化业务价值。极客时间为某制造企业定制 AI 产品经理 OMO 训练营,以业务场景为导向,采用三阶段闭环培养模式,课程覆盖全链路,助企业培养人才、建立培养体系。

AI前线
新闻资讯7

视频生成 vs 空间表征,世界模型该走哪条路?

随着生成模型和潜在表征技术发展,业界探讨世界模型技术路线。是像素级视频预测模拟未来场景可靠,还是潜在空间抽象表征高效?Goole DeepMind的Genie 3发布,再次引发讨论,分歧也从理论走向应用。

机器之心