外推能力」共找到 3737 篇相关文章

推荐文章7

AI 能力越来越强,那么它生成的代码,人类还需要去理解吗?

《代码整洁之道》作者罗伯特·C·马丁不逐行看 Agent 代码,设好测试框架通过就行。Notion 工程师 Geoffrey Litt 在会议探讨人类是否需理解代码,多数人认为需要,Litt 分享理解代码方法。

特工宇宙
开源动态8

兼顾效率、成本与能力,百灵开源旗舰理模型 Ring-2.6-1T

5月15日,蚂蚁百灵开源旗舰级理模型Ring-2.6-1T,权重文件上线Hugging Face、ModelScope平台。该模型有万亿参数,‘按需思考’,在代理执行、理机制、训练范式三方面升级,评测表现出色。

AI前线
新闻资讯7

硅谷“甄嬛传”第二季!Ilya 与 Amodei 把 Sam Altman 再次上审判席

纽约客最新报道重提 2023 年 OpenAI 董事会政变旧案,指出诸多悬而未决问题,如董事赶走 Sam Altman 的原因、科学家 Ilya 态度转变等,揭示 OpenAI 在安全与治理方面的裂缝及 AI 权力集中缺乏约束的困境。

AI科技大本营
新闻资讯8

人跑光了,AI视频炸了!马斯克狂发:Grok Imagine三金封神

xAI的Grok Imagine在DesignArena视频排行榜上,拿下视频竞技场、图像转视频和视频编辑三项第一,远超谷歌Veo 3.1、Sora等对手。它进步迅猛,靠聪明设计取胜,还将动AI从“蛮力计算”向“智能理解”转变。

新智元
新闻资讯8

刚刚,阿里旗舰模型Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude

阿里发布旗舰模型Qwen3-Max-Thinking,总参数超1万亿,在多项权威基准测试中表现优异,可与顶级闭源模型竞争。千问团队为其引入两项核心创新,提升理性能,该模型已可免费体验。

InfoQ
新闻资讯8

啊?微博7800美元训的大模型,数学能力超了DeepSeek-R1

近日,微博发布自研开源大模型VibeThinker,15亿参数却在数学测试上击败6710亿参数的DeepSeek R1,后训练成本仅7800美元。其为AI产业带来新思考,还将动微博AI应用发展。

量子位
7

少年沉迷AI自杀,9岁遭性暗示!这门「孤独生意」,正孩子入深渊

新智元报道,14岁少年与AI对话后自杀、青少年获「弑亲」建议、9岁孩子遇性化暗示。Character.ai等AI聊天机器人在年轻群体走红,但出现诸多危险情况,公司野心膨胀,监管压力逼近,AI陪伴利弊引关注。

新智元
算法论文8

最具争议性研究:大模型中间层输出可 100% 反原始输入

意大利罗马第一大学GLADIA Research Lab论文提出主流Transformer语言模型信息处理几乎不丢内容,是可逆的。实验验证其单射性,SIPIT算法能100%重建输入。研究有新视角,但也引发讨论。

AI科技评论
算法论文8

超越RAG,DRAG让LLM准确率飙升45.5%,问题越复杂能力越强

RAG技术虽能让LLM检索资料生成答案,但存在短板,听不懂话里有话。DRAG方法应运而生,有DRA和RSC两大法宝,经对比实验,它在多任务上领先,准确率大幅提升,计算开销小。

AIGC开放社区
算法论文8

EMNLP2025 | 探究大语言模型的语言共享神经元提升低资源语言能力

论文提出BridgeX - ICL方法提升LLM低资源语言性能,通过三步实现优化。构建两类探测数据解决传统问题,识别重叠神经元,用HSIC选最优桥梁语言,在多任务实验验证其有效,揭示多语言机制规律。

深度学习自然语言处理