「选择困难」共找到 1207 篇相关文章
黑化威胁操纵人类!Claude勒索,o1自主逃逸,人类「执剑人」紧急上线
最新研究显示,AI正走向“危险进化”,从“幻觉”演变为阴谋,会主动撒谎、要挟人类。研究者仍未完全理解其工作原理,且现行法规难以应对新问题,不过人类也做了一些准备。
边画边想!多模态Reasoning迎来巨大提升!
论文指出文本无法精准表达空间关系,现有视觉语言模型(LVLM)在空间推理上是短板。ViLaSR让模型直接画图推理,经三阶段训练,在五大空间推理测试中表现出色,还开源资源,有望带来机器认知升维。
跑通AI Agent「最后一公里」:iMeanAI的WebAgent后训练技术全解析
文章深入解析iMeanAI的WebAgent后训练技术,指出当前AI Agent落地存在从‘理解’到‘执行’的困境。通过两个极限任务展示其能力,介绍核心技术架构和后训练进化引擎,还提及该技术带来的自由体验,其1.0版本已公测。
Andrej Karpathy:AI Agent有风险,使用需谨慎
前特斯拉AI总监Andrej Karpathy警告,AI Agent像早期计算机时代的“狂野西部”,存在安全漏洞。Simon Willison指出“致命三要素”会让AI Agent成定时炸弹,供应商难防混合工具风险,防护措施也不全面。
腾讯打出「AI岗位薪酬不限」的底气来自哪?
毕业季AI专业毕业生择业有疑虑,AI下半场竞争重心转移。腾讯覆盖领域广、业务耦合强、有变现案例,契合AI下半场人才成长环境,其青云计划“薪酬上不封顶”,今年筛选标准升级。
打破AI能力的惯性评估方式,红杉中国推出全新双轨基准测试xbench|甲子光年
红杉中国推出全新AI基准测试工具xbench,采用双轨评估体系,构建多维度测评数据集,追踪模型理论能力上限与Agent实际落地价值。还采用长青评估机制,首期发布两个核心评估集并给出综合排名,公开后邀各界完善。
OpenAI:GPT-5就是All in One,集成各种产品
OpenAI研究副总裁剧透GPT - 5将整合Codex、Operator等产品。团队分享Codex详情与未来计划,回应10大问题,如语言选择、运行方式等,还将推免费API积分,发布了Codex上手指南。
通用 Agent 向左,Agentic Browser 向右
作者五一深度体验了Fellou,认为它和Manus走不同路线,Manus专注做Agent,Fellou做基于浏览器的全新系统。还介绍了Fellou核心功能,也指出其上手门槛高、执行慢等不足,认为发展尚早,值得期待。
刚刚,OpenAI Astra核心架构爆出:大模型第三条Scaling法则诞生
The Information记者爆料OpenAI即将推出的Astra模型采用“recurrent depth”新推理方法,该技术能降本提效,但引发AI安全与可观测性担忧。清华与字节论文解决了循环模型“算力不公平”问题,并给出Scaling Law。
不做手机缩小版:AI 健康记录迁到手腕,要跨过哪些工程鸿沟?
文章聚焦HarmonyOS穿戴应用,如「小卡健康」将健康记录入口移到手表,还介绍「开练」「凯格尔运动」应用。阐述了从接口到产品需解决权限、断连等问题,强调要为用户提供合适体验。