早期答案收敛」共找到 456 篇相关文章

新闻资讯8

刚刚,OpenAI最强推理模型o3-pro诞生!碾压Gemini 2.5 Pro击穿底价

OpenAI昨夜官宣上线最强推理模型o3 - pro,还将o3价格暴降80%。o3 - pro专为深度思考和提供超可靠答案而生,在多项测试中表现优异,虽有速度慢等限制,但优势明显,网友实测效果惊艳。

新智元
产品应用8

昨晚,OpenClaw大更新,亲手终结「旧插件」时代

昨晚OpenClaw重大版本更新,内容多到需单独做目录梳理。重点在ClawHub插件市场、多模型支持等。最重要变化是插件生态重心转向,且体系大改、工具能力收敛,还在多方面有更新,创始人指出正式版有功能加载问题。

机器之心
新闻资讯7

当AI比我们更聪明:李飞飞和Hinton给出截然相反的生存指南

如今AI发展火热,人类对其安全担忧已久。李飞飞和Hinton在Ai4 2025上给出相反答案,前者认为AI会成人类伙伴,安全性靠设计等;后者觉得超级智能或难控制,要造‘关心人类’的AI。还探讨了AI行为两种解读。

机器之心
7

从 AI 招聘到数据标注,Mercor 能否打造下一个 Scale AI?

Mercor 从 AI 招聘平台转型为数据标注服务提供商,与 Scale AI 竞争。它利用早期人才招聘积累,为小规模、高难度项目提供灵活方案,虽数据质量待提升,但增长快,2025 年初 ARR 达 7500 万美元,获 1 亿美元 B 轮融资。

海外独角兽
产品应用8

千问Qwen旗舰预览版Qwen3.6-Max-Preview发布

千问Qwen发布下一代旗舰模型早期预览版Qwen3.6 - Max - Preview,在权威评测中登顶最佳国产模型。此前开源的Qwen3.6 - 35B - A3B用30亿激活参数匹敌数百亿参数稠密模型,新模型在多方面给出技术演进方向。

AIGC开放社区
算法论文8

RAG搜对了却答错?德国萨尔大学找到了真相丨ACL'26

RAG已成大模型落地标配技术,但存在搜到对的文档、模型答案却离谱的痛点。德国萨尔大学等组成的团队诊断出问题在阅读理解,提出Disco - RAG框架,在“搜”和“答”间加“读懂”环节,已被ACL 2026主会录用。

量子位
新闻资讯8

谷歌创始人罕见反思:低估 Transformer,也低估了 AI 编程的风险,“代码错了,代价更高”

谷歌联合创始人 Sergey Brin 在公开对话反思,低估了 Transformer 和 AI 编程风险。他认为 AI 写代码易出错,更适合创意类工作。还回顾谷歌发展,提及早期研究的自由氛围及后来的决策,指出算法进步比规模扩张快,算力如甜点。

AI前线
算法论文8

超越GPT-4o!华人团队新框架让Qwen跨领域推理提升10%,刷新12项基准测试

加拿大滑铁卢大学与TikTok新加坡的华人团队提出全新训练框架General - Reasoner,让Qwen系列大模型跨领域推理准确率提升近10%,在多项基准测试中超越GPT - 4o。该框架有全领域推理数据集和生成式答案验证器两大创新。

量子位
算法论文7

LLM+RL遭严重质疑,随机/错误等虚假奖励也能提升至标准效果?

论文在AI领域观察到类似随机给糖或奖励错误答案让孩子成绩提升的现象,‘虚假奖励四大奇招’效果接近用标准答案训练,Qwen2.5 - Math - 7B模型在测试集上性能飙升,还揭示了Qwen特别的原因及随机奖励有效的推手。

深度学习自然语言处理
新闻资讯8

解析科大讯飞:把AI做成懂你的那一个|甲子光年

2025年中美AI发展路径分化,中国企业探索本土商业化道路。科大讯飞董事长刘庆峰提出自主可控、软硬一体、行业纵深、个性化四个关键词。其用华为昇腾芯片训练出可商用大模型,在多领域展现优势,还发布新功能和产品,为AI商业化提供“中国答案”。

甲子光年