「视觉x代码」共找到 2517 篇相关文章
Test Time Scaling Law远未达到上限! o4-mini仅15.8%通过率,华为诺亚提出代码HLCE终极基准
华为诺亚研究员推出全新编程基准HLCE,含235道竞赛难题。实验显示,顶级LLM在该基准表现不佳,推理模型优势大,IOI交互式题难攻克。研究还发现模型自我认知与推理能力发展不同步,Test Time Scaling Law远未达上限。
十周前才写下第一行代码,如今颠覆 9 个行业?员工人均 10 万粉,00 后创业者狂言:我们将超越 OpenAI
本文聚焦 21 岁 00 后创业者 Roy Lee 和他的桌面 AI 助手 Cluely。该产品获高额融资、估值达 1.2 亿美元且已盈利,但也饱受争议。文中还揭秘其成功热度的关键、团队情况,探讨 AI 时代产品留存演变。
腾讯混元 x MBZUAI 港中文新研究:将纠错纳入策略空间,Search-R2 重构搜索增强推理学习方式
过去大语言模型能力提升靠参数和数据扩张,但在真实任务中此路径有局限。腾讯混元、MBZUAI、港中文联合团队提出Search - R2,将纠错纳入策略空间,抑制错误传播,在多跳推理任务中优势显著。
9B 模型“平替”GPT-4o ?!面壁赌对OpenClaw端侧AI,内部上演一人月产65万行代码的效率核爆
2023年面壁智能转攻端侧大模型,起初遭质疑,后获市场认可。今年发布开源全模态模型MiniCPM - o 4.5,年中还将推AI硬件松果派。其内部有“一人公司”趋势,对未来端侧智能发展有清晰判断。
“大模型第一股”打响上市前哨战!智谱GLM-4.7 刷新开源编程SOTA,修复代码、终端操作表现超Claude 4.5
冲刺大模型第一股的智谱推出开源大模型GLM - 4.7,主打编程与代理式任务提升。它在多项基准测试中表现出色,UI质量飞跃,还采用新推理机制。智谱上市在即,但亏损扩张快,研发投入大。
半年研发、1周上线,1秒200行代码爆发?美团研发负责人:靠小团队奇袭,模型和工程能力突破是核心
美团基础研发平台工程效率负责人程大同在访谈中解答了美团 AI Coding Agent 产品 NoCode 的相关问题,包括模型性能优化、产品定位、用户画像、使用边界等,还谈及与 CatPaw 的关系及未来规划。
半年研发、1周上线,1秒200行代码爆发?美团研发负责人:靠小团队奇袭,模型和工程能力突破是核心
6月10日美团推出首款AI Coding Agent产品NoCode。美团基础研发平台工程效率负责人程大同在访谈中解答诸多问题,如模型性能优化、产品竞争力、用户使用难点等,还提及产品未来规划和对行业发展的看法。
万人见证,“出轨”CEO被停职;陶哲轩评“OpenAI内部实验模型获IMO金牌”;传字节Seed视觉负责人“暂休”|AI周报
这是一篇AI行业周报,涵盖多领域热点。如Manus季逸超复盘Agent研发经验;陶哲轩评OpenAI模型获IMO金牌;字节跳动绩效改革、人员变动;还有企业动态,像英伟达黄仁勋访华、宇树科技开启上市辅导等。
深谋科技独家发布真正为人类服务的新一代人形机器人核心技术「声波传感 · 意念控制 · 高精视觉 · 类脑智能」
2025世界人工智能大会7月将举行,深谋科技作为精英合作伙伴参展。其秉持服务人类理念,携系列核心技术亮相。有独创传感系统、脑机交互方案等,还将推通用具身智能世界模型。
假设 AI 未来真的能在写代码和系统设计上超过人类,那还有必要学习编程和系统设计吗?
文章围绕AI未来在编程和系统设计上能否超人类展开探讨。分析AI编程效率未达预期的原因,指出短期内不会有完全面向AI的软件架构,还强调学习编程和系统设计知识可培养解决问题的能力。