AI 大模型」共找到 14074 篇相关文章

算法论文8

LLM进入「拖拽时代」!只靠Prompt,几秒定制一个模型,效率飙升12000倍

新智元报道,NUS、UT Austin等机构研究人员提出「拖拽式语言模型」(DnD),它基于提示词生成模型参数,无需微调适应任务,效率最高提升12000倍,零样本泛化能力出色。

新智元
算法论文8

Loop-ViT:让AI学会「反复思考」,3.8M参数小模型追平人类平均水平

香港科技学等团队提出 Loop - ViT,将循环 Transformer 引入视觉推理领域。该模型参数少但性能强,3.8M 小版本追平人类平均水平,揭示视觉推理任务中‘思考时间’比‘模型小’更重要。

机器之心
7

Anthropic发布AI就业冲击报告,数据让人意外

Anthropic发布AI对劳动力市场影响的报告,基于真实数据和理论智能分析。提出“观察暴露度”新指标,揭示AI理论能力与实际应用差距,还给出高危职业排行,分析受影响人群、安全职业等。

AI工程化
开源动态8

EMNLP 2025 | CARE:无需外部工具,让模型原生检索增强推理实现上下文高保真

MetaGPT等机构团队发布CARE框架,可让LLM将推理上下文与自身检索能力结合,已全面开源。它提出原生检索增强推理范式,采用两阶段训练策略,在问答基准实验中表现出色,为解决模型问题提供新路径。

机器之心
开源动态7

被DeepSeek带火的OCR,最新8个开源模型盘点~

DeepSeek-OCR发布让OCR热,PaperAgent梳理盘点8个热门开源OCR模型,如DeepSeek-OCR用‘上下文光学压缩’技术,Nanonets-OCR2-3B以零样本视觉链式思维为核心等。

PaperAgent
新闻资讯7

Cursor一夜翻车,AI 300万代码写浏览器被打假!全网群嘲「AI泔水」

Cursor宣称GPT - 5.2连肝7天造出浏览器,但开发者发现其代码无法编译,是缺乏工程逻辑的“AI泔水”。这一行为激怒开发者,也揭示AI编程需明确分工,未来软件开发靠“开挂工程师”带领AI

新智元
新闻资讯8

罗振宇、张鹏、王立行等齐聚一堂,AIFUT会Day1上午场的全面总结来了。

AIFUT会首日上午,多位嘉宾分享观点。王磊谈亦庄如何拥抱AI;卡兹克称身份被重新定义,好奇心不可被定义;罗振宇认为人最后价值是告诉AI要什么;还有Tim、张鹏、谷白话、王力行等分享见解。

数字生命卡兹克
产品应用8

昨晚,OpenClaw更新,亲手终结「旧插件」时代

昨晚OpenClaw重版本更新,内容多到需单独做目录梳理。重点在ClawHub插件市场、多模型支持等。最重要变化是插件生态重心转向,且体系改、工具能力收敛,还在多方面有更新,创始人指出正式版有功能加载问题。

机器之心
产品应用8

万卡竞赛背后:容器正在成为AI时代的调度

今年 Agent 与 AIGC 应用爆发,Gartner 预计 2027 年超 75%的 AI/ML 工作负载将用容器技术部署。但现有容器技术栈不能直接用于 AI 业务,需解决两技术挑战。阿里云 ACK 和 ACS 协同演进,应对挑战并不断突破,还积极投入开源。

InfoQ
新闻资讯7

科学界爆发AI认知污染!1年狂投50篇论文,ICLR投稿20%AI生成

如今AI正污染科学界,出现幽灵引用、虚假数据和图片等问题。论文工厂用模板量产造假论文,审稿人用AI应对,作者还用密令操控AI审稿。预印本平台投稿量暴涨,可能沦为垃圾场,引发认知污染。

新智元