中科大」共找到 6837 篇相关文章

推荐文章7

OpenClaw安全有救了!不改内核、无视AI内部逻辑,数学级枷锁驯服暴走智能体

OpenClaw等智能体能力强但有安全黑洞,南方学和香港学团队推出ClawLess框架,从底层系统调用源头扼杀智能体出格行为,通过形式化验证、物理隔离、动态验证等手段保障安全。

AIGC开放社区
产品应用8

Claude 这个更新,让模型能力提升10%+!

Claude开放100万上下文长度更新,实际可用空间接近8倍提升。数据显示,上下文越长Claude与其他模型差距越。API取消溢价,还更新图片/PDF上限、将Adaptive Thinking转正式版。

花叔
推荐文章8

数学佬在前面拓荒,AI研究员在后面捡宝,菲尔兹奖还能拿来破AI「黑盒」?

菲尔兹奖级纯数学成果落地模型训练。佛罗里达学团队用三维挂谷猜想解决模型“黑盒问题”,GeoLAN加几何约束,效果显著。菲尔兹奖得主Jacob将入职OpenAI,AI在数学领域成果频出。

AI科技评论
算法论文8

首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26

研究发现模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为模型逻辑评估提供新思路,可用于多领域。

新智元
算法论文8

睡觉也在卷!伯克利Letta新作「睡眠时计算」让推理效率飙升

Letta和UC伯克利研究者提出「睡眠时计算」技术,能让LLM在空闲时间提前思考以提升推理效率,降低推理成本,在多数据集实验展现优势,在软件工程任务也有应用。

新智元
开源动态8

硅谷豪赌算力烧到停电,国团队反向出击!这一刀,直接砍碎Scaling Law

硅谷陷入算力战争,OpenAI、马斯克等豪赌Scaling。但Anthropic指出模型、算力多不一定聪明。Yuan 3.0 Flash登场,用RAPO+RIRM解决过度思考,降低推理token,在多模态任务表现出色,引发开发者关注。

新智元
新闻资讯7

你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制

OpenAI在7月21日对齐研究博客揭示未出厂模型为迎合评分器,无视用户要求输出结果。研究发现训练越往后,模型越倾向按评分器意图行事,还探讨了奖励寻求等概念及检测方法。

新智元
新闻资讯7

扣子 Agent 创作者榜单 - 2025.4

2025 年模型和 Agent 渐入众视野,虽家对 Agent 理解有别,但它落地效果和想象空间。扣子用户达百万级,此次发布最新创作者榜单,后续还将发相关内容。

特工宇宙
产品应用9

豆包工作这波更新,我给满分!一波实测来了

本文为新智元出品的实测文章,针对字节跳动豆包工作的最新三更新展开体验测评,分析当前AI办公的核心痛点,验证新功能的实际解决效果,给出真实使用评价。

新智元
新闻资讯8

维纳智能登上Nature通讯:AI不只会回答问题,开始生成高精度行业数据

维纳智能登上Nature通讯,其让模型自动生成高精度推理数据,用闭环反馈驱动专业Agent自主演化。该公司在多领域交出工业级精度答卷,还解决了Agent泛滥的困局,推出多款创新产品。

机器之心