「能力发现」共找到 3977 篇相关文章
谷歌AlphaEvolve太香了,陶哲轩甚至发了篇论文,启发数学新构造
著名数学家陶哲轩与 Google DeepMind 研究人员发表论文,展示谷歌 AlphaEvolve 作为工具可自主发现新数学构造,该系统结合 LLM 与进化计算,在多领域问题上表现出色,还能与其他 AI 工具结合。
Sora 2瑟瑟发抖!通义万相2.5放大招:一句话出1080P电影,音画精准同步
云栖大会上通义万相2.5系列模型亮相,包含四大模型,视频生成模型实现音画同步突破,降低电影级视频创作门槛。它创作能力全方位升级,支持多种模态输入,采用原生多模态架构。
蛋白质基座的GPT时代来了?!
清华大学周浩课题组联合上海人工智能实验室发布蛋白质基座模型AMix - 1,以系统化方法论构建,实现蛋白质基座领域从BERT到GPT时代跨越,有四大‘超能力’,设计的蛋白活性提升50倍,代码等已公开。
代季峰陈天桥联手AGI首秀炸场!最强开源深度研究模型,GAIA测试82.4分超OpenAI
MiroMind ODR是代季峰加盟陈天桥后的技术首秀,GAIA测试82.4分超OpenAI。它全开源可复现,包括MiroFlow、MiroThinker等四个子项目。团队还曾推出MiroMind - M1,专注提升数学推理能力。
史上最大高质量科学推理后训练数据集开源,快速让Qwen3等变“科学家”
上海创智学院、上海交通大学发布开源科学推理后训练数据集MegaScience,含约125万条问答对,覆盖多学科。它解决了现有数据集的问题,实验显示能提升模型科学推理能力,已完整开源相关组件。
不,AI 并没有让工程师的生产力提高 10 倍
作者 Colton Voege 分享自身经历,指出 AI 未让工程师生产力提升 10 倍。试用多种 AI 编程工具后,发现其有局限。从算笔账、分析 10 倍工程师等方面论证观点,还剖析鼓吹 AI 者的情况。
AI真的需要「像人类」那样思考吗?AlphaOne揭示属于大模型的「思考之道」
近年大模型在推理任务有进展,但缺乏推理节奏调控能力。伊利诺伊大学厄巴纳 - 香槟分校和加州大学伯克利分校研究提出 AlphaOne 框架,引入 α - moment 实现无需训练的推理调控,实验显示其能提升准确率和效率。
提升大模型内在透明度:无需外部模块实现高效监控与自发安全增强|上海AI Lab & 上交
大语言模型能力提升引发风险担忧,当前主流用外部“黑盒”监控模块解读模型表征,存在诸多局限。上海人工智能实验室和上海交通大学团队提出TELLME方法,摒弃外部模块,提升模型内部透明度,还提升了输出安全性。
AI还不会独自问诊,o3准确率仅为51.12%,上交大×SII开源高难度复杂疾病诊断测评集
上海交大与SII团队开源高难度复杂疾病诊断测评集DiagnosisArena。测试显示,现有大模型在复杂临床诊断任务中表现不佳,o3准确率仅51.12%,且选择题设置无法反映其真实能力。
实测 Google I/O 放出来的 Imagen4,不如GPT4o、甚至不如Imagen3。。
作者实测 Google I/O 推出的 Imagen4,发现它在生成封面图时审美和文字表达不佳。对比 Elo 评分及实际出图,在指令遵循、细节还原等方面,Imagen4 不如 GPT4o 甚至 Imagen3。