飞书大会」共找到 6011 篇相关文章

新闻资讯7

2025年了,AI还看不懂时钟!90%人都能答对,顶尖AI全军覆没

AI基准ClockBench测试AI读模拟时钟能力,人类平均准确率89.1%,11个主流模型最好仅13.3%。研究展示了LLM局限性,分析了可能原因,还对比了不同模型表现及在各类问题上的差异。

新智元
新闻资讯8

谷歌Nature震撼发文,Gemini教练暴打专家!医学双料冠军,秒出睡眠报告

谷歌DeepMind把Gemini版模型PH - LLM调教成「AI健康私教」,将可穿戴设备数据转化为睡眠健身建议,准确率超人类医生。它经两阶段训练,在多项测试中表现优异,或开启预防医学未来。

新智元
开源动态8

Meta刚刚开源DINOv3,横扫60+任务,无标注封神!

今天凌晨,Meta开源视觉模型DINOv3,采用自我监督学习,无需标注数据。它在60多个视觉任务测试中表现出色,超越同类模型。还引入后处理优化策略,扩展应用场景,能适应多种部署环境。

AIGC开放社区
新闻资讯7

Sam Altman宣告软件开发即将进入"快时尚时代"!机遇还是危机

Sam Altman宣告SaaS将进入快时尚时代,新的GPT - 5编程能力或让开发SaaS像Zara出新款般轻松。但此概念最早由Patricio提出,他认为AI编程带来‘代码污染’,与Sam态度不同。

AI工程化
算法论文8

强化学习新发现:无需数学样本,仅游戏训练AI推理

莱斯学、约翰斯・霍普金斯学和英伟达研究团队有颠覆性发现,让多模态语言模型玩简单游戏,无需数学样本,就能显著提升其多模态推理能力。提出的ViGaL方法在多个基准测试中表现出色。

机器之心
新闻资讯7

CSDN 创始人蒋涛:“码盲”消失,新程序员崛起

CSDN 创始人蒋涛在演讲指出,从传统互联网到 AI 是底层变迁,要翻越美国‘三座山’实现从 Global AI 到 Local AI。他预言‘码盲’将消失,新程序员崛起,AI 还能重写硬件,中国机遇

AI科技大本营
算法论文8

横扫八数学竞赛:清华微软联合提出STAR-PólyaMath,Apex基准超GPT-5.5 13.5%

清华学与微软亚洲研究院团队提出推理多智能体系统 STAR - PólyaMath,构建探索 - 推理 - 验证框架,解决模型长程数学推理瓶颈,在八数学竞赛基准获最优成绩,还可泛化到其他推理场景。

机器之心
算法论文8

重新审视SFT的泛化能力:优化动态、数据与模型能力的条件性分析

上海人工智能实验室等联合研究质疑了‘SFT倾向于记忆,RL实现泛化’观点,指出SFT泛化是条件性现象,受优化动态、训练数据、基模型能力影响,还揭示长思维链SFT带来安全性能退化。

AI科技评论
产品应用7

企业级靠谱龙虾升级,拒绝失控

OpenClaw爆火又降温,凸显轻量化智能体短板,企业需具精准业务理解和多技能协同能力的AI员工。滴普科技升级Deepexi企业模型,其与两平台构成DeepexiOS,支撑企业AI体系化建设。

量子位
新闻资讯8

10级漏洞刚补完,React又炸了!现代Web“默认底座”因一行代码缺失引发全球地震,开发者经历最黑暗一周

12月12日,React官方确认RSC里有两处新漏洞。此前React2Shell漏洞危害,超两百万台服务器有风险,开发者服务器被入侵挖矿。该漏洞因核心通信机制缺一行校验代码,Vercel等平台受波及。

InfoQ