推理能力提升」共找到 6171 篇相关文章

开源动态8

AI编程里程碑!谷歌AI自己写代码惊呆工程师,GPU内核算法反超人类21%

谷歌AlphaEvolve的开源实现OpenEvolve自学写代码,在苹果芯片上进化出比人类快21%的GPU核函数。它自主发现多项优化策略,经多维度测试,性能显著提升,开启「AI为AI编程」新时代。

新智元
新闻资讯8

AI正在淘汰“中间层”!昆仑万维方汉:要么冲进前10%,要么学会“向下兼容”

InfoQ专访昆仑万维方汉,他认为AI将推动“智能化”,是全面提升行业效率的“催化剂”,会淘汰“中间层”从业者。企业应快速试错,出海要选好市场、做好本地化。此外还探讨了开源、AI应用等话题。

AI前线
产品应用7

用Cursor做UI,最有效的两个方法

作者黄益贺分享用Cursor做UI的两个方法,免费法是用Gemini等生成JSON配置贴到Cursor;付费法是API调用Vercel的v0模型。还提及添加动画提升体验及前端UI开发工具箱。

newtype AI
产品应用7

突破视频时长限制!Manus上架视频生成功能,网友:比Sora更好

Manus上架视频生成功能,可通过连续拼接突破时长限制。它按“拍电影”方式,根据提示词生成片段再合成故事。网友评价是新创作方式,但效果有提升空间,部分人认为比Sora好。

量子位
新闻资讯8

Jeff Dean:一年内 AI 将取代初级工程师,网友:“Altman 只会画饼,Jeff 说的话才致命”

谷歌传奇工程师 Jeff Dean 在访谈中预测,一年内将有具备‘初级工程师’能力的 AI 系统。他还谈到 AI 发展方向、智能体潜力、大模型格局等,也提及硬件重要性及 AI 在科研领域的影响。

AI前线
算法论文8

人类打辩论不如GPT-4?!Nature子刊:900人实战演练,AI胜率64.4%,还更会说服人

瑞士洛桑联邦理工学院等机构研究人员让900名美国参与者与人类或GPT - 4就社会议题辩论。发现GPT - 4知晓对手信息时胜率64.4%,说服效果提升81.2%,低/中争议话题更易受其影响。

量子位
新闻资讯7

codex负责人:codex就要过时了

Codex负责人称两三个月后Codex将过时,因下一代模型要处理大规模并发Agent,非其能应对。Huggingface实验显示大小模型在不同harness下排名差异大,脱离模型谈harness过时或不适配说模型Agent能力都不妥。

探索AGI
推荐文章7

「说 Harness 会被淘汰的,肯定没做过工程」,Kimi 前 CLI 负责人戳破了 AI 圈最大的误解

AI编程圈两极分化,围绕底层Harness是否消失争议不断。前Kimi CLI负责人stdrc提出反常识观点,认为模型越强Harness越厚,复杂度从“能力层”转移到“协作层”,还以Kimi CLI实践及Raft创业为例阐述。

AI科技评论
推荐文章7

当 Token 成为商品,AI 基础设施会怎么变化?

在大模型时代,智能生产和交付未实现工业化,存在性能鸿沟。九章云极提出AI工厂战略,发布Alaya NeW Cloud 3.0,将从资源计量转向智能计量,打造训练和Token工厂,提升算力到有效Token的转化效率。

InfoQ
开源动态7

2.1K星CCPM:多Agent任务,流水线一样并行Coding

CCPM基于GitHub Issues + Git worktrees,有严格五阶段流程。多agent负责同一issue不同子任务,实现任务级并行,最高提升3倍交付速度,75%降低Bug率,还能避免上下文丢失等问题,有详细工作流程和命令。

CourseAI