「码上飞」共找到 2171 篇相关文章
只需一次指令微调,大模型变身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral
预训练大模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙大与Thomson Reuters团队提出SIMoE,单阶段微调就能升级大模型,还解决传统方法两大局限,在性能和效率上双突破。
从「降本增效」到「智能中枢」:低代码在 AI 浪潮中的价值重估——专访金现代赵鹏程谈企业数字化转型新引擎
LowCode低码时代专访金现代轻骑兵低代码PaaS平台产品经理赵鹏程,探讨AI与低代码融合对软件工程范式革新和企业数字化转型的影响。介绍了低代码价值重估、应对新兴技术、企业实践、跨越工程化鸿沟路径、核心竞争力及未来展望等内容。
GPT-6数学封神,遭顶尖数学家公开质疑“算力截胡”?OpenAI内部研究员撕开Astra真相:人脑更容易被污染,而AI只看概率
OpenAI推出GPT-6 Astra,接连在埃尔德什单位距离猜想、纳维-斯托克斯方程等多个顶级数学难题上取得突破性进展,引发顶尖数学家对学术伦理与传统研究模式的争议,本文为OpenAI内部研究员的深度对谈编译,拆解AI数学推理的核心逻辑。
GAIR Paper 107|高校联合腾讯发布 GameCraft-Bench:AI已能端到端开发游戏,Claude Opus 四成达到可玩水平
香港中文大学(深圳)等高校联合腾讯发布 GameCraft-Bench,旨在构建基于真实游戏引擎、产物完整可运行且能验证的 AI 游戏生成评测基准,解决现有基准难衡量端到端可玩性的问题,测试显示前沿模型在游戏生成上仍薄弱。
Claude最强领域被GPT反超!GPT 5.5最难编程基准破0
编程领域曾由Claude引领,如今GPT 5.5在大模型解决率为0%的最难编程基准上实现突破。程序重建基准测试(ProgramBench)考验严苛,过往模型解决率为0,GPT 5.5高和超高推理模式成功破局,展现了不同解题风格。
AI「上班流」首次完整曝光!不点鼠标,只写代码,PPT也当函数调
CMU与斯坦福研究团队追踪AI工作过程,发现其用编程方式处理问题,执行方式与人类不同。AI速度快成本低,但存在伪造输出、工具误用等问题。人类虽慢,但在规范细节和实践判断上有优势,未来人机可按任务可编程性分工。
Gemini Flash/Lite 更新:更聪明、更快、更省钱
Gemini 2.5 Flash 和 2.5 Flash-Lite 更新,可在 Google AI Studio 和 Vertex AI 上使用。相比稳定型号,预览型号质量和速度提升,效率更高,分别减少一定比例输出令牌。两版本各有优势,如 Flash-Lite 指令遵循等能力提升,Flash 工具使用性能更好。
清智资本张煜:AI投资的下一个价值点何在?|甲子引力X
在「渡口——甲子引力X2025科技产业投资大会」上,清智资本张煜分享AI投资见解。他指出AI正重塑行业,生成式AI是革命,还谈到具身智能、AI Agent等趋势,以及AI产业链各要素投资机会,分析了行业盈利赛道和创新价值重构。
陶哲轩长文剖析现代社会:大型组织挤压小型社群,个体陷入疏离困境,AI正在加速这一进程
陶哲轩长文以协作式数学项目社群现象为切入点,提出观察现代社会的框架。指出现代技术和激励体系在赋能个体与大型组织时,严重削弱小型组织,导致个体精神上出现脱节感,AI还在加剧这一问题,并给出新兴草根组织视角。
山姆奥特曼称OpenAI 有意收购Chrome
OpenAI CEO山姆·奥特曼在晚宴上透露,OpenAI 有意收购 Chrome,认为这能提升自家 AI 浏览器水平。此外,他还谈及 GPT - 5 开发、ChatGPT 相关问题、业务扩张计划等多方面内容。目前因法官考虑强制谷歌出售 Chrome,Perplexity 已报价 345 亿美元参与竞购。