「核心认知能力」共找到 4802 篇相关文章
GenAI 退烧后,这家企业正在用 “数据平台” 重构AI2B的底层逻辑
GenAI浪潮下,企业级AI落地难。矩阵起源举办新品发布会,其CEO王龙指出落地瓶颈已从大模型转向私域数据。该司推出MatrixOne和MatrixOne Intelligence,构建“数据智能飞轮”,MOI三层架构可打通数据到业务落地流程,还通过案例展现其解决实际痛点能力。
南大团队直击大模型高分神话:人类90分,最强模型仅49分
南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。
GitHub 千星项目:把四款 AI 编码工具变成并行科研 Agent!
本文介绍alphaXiv团队开源的千星项目OpenResearch,针对当前AI编码工具不适合科研循环、多Agent并行冲突等痛点,将四款主流AI编码工具包装成可自动运行完整研究循环、支持多Agent并行探索的科研Agent,核心设计简洁实用,覆盖完整科研工作流。
为什么林俊旸会离职? | 甲子光年
3月4日凌晨,阿里Qwen团队技术负责人林俊旸宣布离职,同一天Qwen后训练负责人郁博文也正式离职。阿里刚开源Qwen 3.5小尺寸模型获马斯克点赞,此时核心团队出走引发关注。林俊旸离职或因团队分拆、管理范围缩小及“开源”与“闭源”的矛盾。
脑子比不过AI,手也要沦陷了?这只灵巧手看得我有点慌
人类手部结构和功能复杂,将其能力复刻到机器人身上是梦想,由此衍生出“灵巧手”方向。但多数“灵巧手”存在不足,世界机器人大会上一款“灵巧手”表现出色。灵巧智能选择柔性传动,其产品DexHand021 Pro优势明显,未来将提升感知和智能水平。
谷歌全线开挂!Gemini 3 Deep Think夺多项推理SOTA,Gemini亚洲新团队也官宣了
谷歌的Gemini 3 Deep Think模式正式上线,推理能力显著加强,在ARC - AGI、HLE等多项权威测评中夺魁,仅向Google AI Ultra订阅用户开放。同时,谷歌DeepMind将在新加坡成立新的Gemini研究团队,由95后华人科学家Yi Tay带队。此外,谷歌还推出了Google Workspace Studio。
Skill vs App:一场入口范式的争夺
量子位举办的「龙虾时代,Skill会吃掉App吗?」主题沙龙上,多位从业者围绕Agent生态、Skill能力边界、App未来形态等话题展开讨论。指出Skills不会完全干掉App,App会以Skill形式继续存在并进化,还探讨了App在AI时代的多种走向及面临的问题。
刚刚,百度抛出“王炸”:全球首个可商用自我演化智能体!李彦宏:技术迭代速度是唯一护城河
在百度世界大会上,李彦宏指出产业结构不均衡问题,介绍AI产业从‘正金字塔’向‘倒金字塔’转变。百度展示内化AI能力成果,如发布数字人、重构搜索、更新秒哒等,还推出昆仑芯、文心大模型5.0和全球首个可商用自我演化智能体百度伐谋。
三个理想火枪手创业,打破具身最快百台交付纪录
至简动力由理想智驾团队三位核心负责人创立,7月6日宣布首款全场景机器人i7 Pro完成首批百台交付,创下具身智能行业最快纪录。其与绿的谐波子公司合作落地全球首个CNC智能化具身机器人产线,i7 Pro还进入多场景。公司计划进入多领域,将发布新品。
阿里:RL强化LLM推理,是技巧还是陷阱?
近年来,强化学习(RL)成为解锁大型语言模型(LLM)复杂推理能力的关键工具,但该领域也面临技术选择困境。阿里联合多所高校的论文通过大规模可复现实验,揭示主流RL技巧的机制与适用场景,还发现极简组合(Lite PPO)性能超越复杂方案。