「可重构计算」共找到 5283 篇相关文章
高考数学全卷重赛!一道题难倒所有大模型,新选手Gemini夺冠,豆包DeepSeek并列第二
因网友质疑上次测评不严谨,此次用六款大模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态大模型。
告别App孤岛,天翼AI如何用统一入口重构数亿用户的数字生活?|甲子光年
2025年中国AI行业模型能力强但用户体验复杂,存在数字鸿沟。中国电信在数智科技生态大会上,天翼AI发布星辰智能体服务平台1.0,以统一入口“星小辰”智能体重塑入口逻辑,还在多领域布局扩张能力。
沈向洋解读AI演进五大维度!IDEA研究院发布“万物可抓取”模型,GPU渲染器打破国外垄断
沈向洋分享梳理智能演进的五个维度,包括算法范式、智能载体等,指出机会不仅来自技术本身。此外,IDEA研究院还发布“万物可抓取”DINO - X Grasp模型、MoonBit编程语言、GPU渲染器Smart等创新成果。
1周半写64个PR、完成30%项目重构:一家成熟SaaS公司把Agent塞进研发全流程后
Calendly公开Agentic Engineering实践,Agent嵌入研发全流程,如审查需求、写代码、测试等。一周半内,Agent为IAM团队生成64个PR,完成30%项目重构。研发瓶颈从写代码转为判断力,强调好需求与护栏重要性。
大模型能“原地”改参数了!字节Seed&北大新论文:测试时推理无需加层重训练
字节Seed和北大研究团队提出In - Place TTT方案,让大模型能“原地改参数”。它复用Transformer的MLP模块,解决现有TTT架构不兼容、计算效率低和优化目标不匹配问题,实验证明可提升模型长文本任务表现。
靠AI把股价干涨735%,这家公司开始成批裁掉可替代岗,全员招聘须CEO点头
AppLovin联合创始人兼CEO Adam Foroughi分享公司发展历程。他曾借钱60亿美元回购股票获600亿美元回报,押注AI使股价涨735%。公司经历人员结构调整,清退老高管和可被LLM自动化岗位,招聘须他亲批,超80%代码由大语言模型生成。
GPT-5正以o3的三倍速度打宝可梦,现已抵达冠军之路,直播进行中
GPT - 5直播独立运行宝可梦红版,速度比o3快近三倍,6105步抵达冠军之路,而o3需16882步。原因是其幻觉少、空间推理和规划能力强。直播已进行9小时,超2000人关注,OpenAI总裁点赞。
7 小时连续重构不掉线!一骑绝尘的Claude 终于遇到对手:Greg Brockman亲自解读AI编程重大突破
9月16日,OpenAI推出新模型GPT-5-Codex,专为AI辅助编程工具设计。它在代理编码基准测试中表现佳,形成了覆盖各种需求的交互界面,还具有更优的后训练特性,能连续工作7小时完成复杂重构。
AI玩宝可梦找出30年前代码Bug!谷歌论文介绍AI通关全过程,复杂任务都能解
谷歌Gemini 2.5系列技术报告花长篇幅介绍Gemini 2.5 Pro玩《宝可梦蓝》,它通关游戏,展现出创造力与长期规划能力,还发现游戏代码Bug,但也有幻觉、思维定势等问题。Claude 4已加入比赛。
DMLR 2026 | RPI Shaowu Pan(潘韶武)团队 Nithin Somasekharan等:CFDLLMBench——首个面向计算流体力学的大语言模型综合基准评测
文章介绍针对CFD领域的综合LLM评测基准CFDLLMBench,构建三层递进挑战体系。实验揭示主流LLM在‘知道’与‘做到’间有差距,多智能体框架可提升成功率,代码与数据集已开源。