人类数据」共找到 3517 篇相关文章

算法论文7

超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭

近日MIT研究者发现测试时训练在大模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。

新智元
7

【博客转载】CUDA Vectorized Memory Access (文末送书)

文章展示如何用向量化内存访问提高CUDA函数有效内存带宽,实现朴素自定义设备内存拷贝函数,对比不同数据类型、大小及方法的性能,得出拷贝数据单元多、单元大及以8或16字节向量化单元拷贝可提升带宽等结论。

GiantPandaLLM
推荐文章7

AI 已能写 80% 代码,但 Agent 也有致命短板!OpenAI Codex 技术总监:问错了,比不会写更麻烦

OpenAI Codex 技术负责人 Michael Bolin 在访谈中回顾职业轨迹,分享从工程师到工具创造者的成长经历。他认为 AI 编程时代 80%-90% 代码可由模型生成,但关键部分需人类把控,提出正确问题能力更重要,编程智能体执行将更多迁移到云端。

InfoQ
新闻资讯8

模型训练最重要的依然是 Scaling —— 对话阿里通义千问 Qwen 多语言负责人杨宝嵩 | Open AGI Forum

本文是对阿里通义千问Qwen多语言负责人杨宝嵩的专访。他透露Qwen一开始就将国际化视作核心战略,团队建立文化标注体系确保内容安全合规。还谈到多语言推理难题及应对策略,认为扩大模型规模和数据量仍重要,合成数据是延续Scaling Law的关键。

AI科技大本营
新闻资讯8

谷歌AI掌门人、诺奖得主Demis:AGI 需要打破“金鱼记忆”,而谷歌无论泡沫破裂与否都将是赢家

谷歌AI掌门人Demis接受专访,回应AI是否有“金鱼记忆”、AGI定义等尖锐问题。他认为通往AGI需突破,大模型是核心组件;真正AGI要能执行人类所有认知任务,离实现还有5 - 10年;还看好智能眼镜,强调保护用户对AI信任。

AI科技大本营
新闻资讯7

刚刚,OpenAI正式发布o3-pro!奥特曼激动更新博客:温和的奇点

今日凌晨,OpenAI发布o3-pro,Pro订阅用户可通过ChatGPT和API使用。其在多项任务表现出色,但在ARC-AGI数据集上与o3相近且成本高。网友测试评价不一,此外OpenAI CEO奥特曼还发表博客展望AI未来。

机器之心
新闻资讯7

宣战马斯克!OpenAI进军脑机接口,Altman圆8年前梦想

英国金融时报消息,OpenAI及其首席执行官Sam Altman将支持新脑机接口公司Merge Labs,与马斯克的Neuralink竞争。Merge Labs正融资,估值8.5亿美元,新资金主要由OpenAI风投提供。8年前Altman就提及人类与AI融合,如今他选择支持Merge Labs实现脑机接口梦想。

AIGC开放社区
产品应用8

MiniMax都在用!5500PB幕后功臣首次亮相,国产黑马祭出杀招

AI浪潮中,数据流不动致GPU算力空转,XSKY星辰天合举办AIMesh产品战略发布会破局。AIMesh含三网,分别解决IO墙、重力墙、内存墙问题,且开放解耦,获多方认可。

新智元
新闻资讯7

不只是行业 Know-How,营销类 Agent 工程化落地难题有何解?|对话瓴羊副总裁、友盟+总经理毛波

今年是“AI Agent 元年”,营销 Agent 热门但有难题待解。InfoQ 对话瓴羊副总裁毛波,探讨营销 Agent 落地困境、工程化挑战、未来护城河及发展机会,友盟+推出产品并提供方案助力解决问题。

InfoQ
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十】| “过拟合” 与 Dropout

文章围绕神经网络过拟合问题展开,介绍了过拟合的概念、危害及产生原因,阐述了缓解过拟合的正则化方法,重点介绍了Dropout随机失活,还指出其局限性及在大模型中的应用策略。

AI大模型应用实践