写任务」共找到 2541 篇相关文章

新闻资讯8

谷歌创始人罕见反思:低估 Transformer,也低估了 AI 编程的风险,“代码错了,代价更高”

谷歌联合创始人 Sergey Brin 在公开对话反思,低估了 Transformer 和 AI 编程风险。他认为 AI 代码易出错,更适合创意类工作。还回顾谷歌发展,提及早期研究的自由氛围及后来的决策,指出算法进步比规模扩张快,算力如甜点。

AI前线
推荐文章7

重新定义Skill开发:保姆级教程&一站式开发助手发布

文章围绕Skill开发展开,介绍其定义、安装使用、创建、管理等内容,指出Skill替代重复任务,无法替代体验和判断。还分析Skill生态早期痛点,如跨平台一致性等,并推荐一站式Skill开发助手skill - dev - aio。

阿里云开发者
新闻资讯7

Meta被骂跑偏后摊牌!Alex Wang回应新团队目标:个人Agent全球化部署,Manus已在应用上开路

Meta超级人工智能实验室(MSL)负责人Alexandr Wang发声,称其任务是推动超级智能技术突破并做成产品推向数十亿用户,要把个人Agent全球化部署,还谈到与研究和产品平衡、Meta的AI思路等问题。

AI前线
新闻资讯7

Cursor:AI编程「第三时代」来了

近日,Cursor CEO Michael Truell 称 AI 编程迈入「第三时代」,特征是 Agent 能在少人工干预下完成大规模任务。Cursor 核心转变,内部超 1/3 代码提交由云端智能体创建,团队预计多数开发工作将由其完成。

机器之心
新闻资讯7

Karpathy戳破强化学习神话,首提AI复盘式进化!暴力试错将死

AI大神Karpathy发文指出强化学习(RL)有局限,效率随任务时长下降,与人类学习机制差异大。他提出复盘式进化Scaling范式,虽有很多细节待完善,但认为还有更多S型增长曲线待发现。

新智元
产品应用8

1美金时薪雇个全栈替身,MiniMax M2.5让打工人也能体验当老板的感觉

春节档模型大战,MiniMax官宣新模型M2.5,主打智能体和Vibe Coding,性能比肩Claude Opus 4.6。它全栈能力强,能处理长链路任务,推理吞吐量高、成本低,已接管MiniMax 30%真实业务。

量子位
推荐文章7

什么时候不该微调:比“怎么微调”更重要的一件事

文章指出微调失败常因一开始就不该调。强调微调解决行为问题而非能力问题,还列举了不该微调的五种场景,如知识接入问题、Prompt没好等,建议先验证思路,明确目标再行动。

机器学习AI算法工程
算法论文8

LLM规划能力飙升79%!Google:内在自我批评技术拿下多项SOTA

Google DeepMind研究《通过内在自我批评提升大语言模型的规划能力》,不借助外部验证器,让LLM反复“自评+重”,使Blocksworld准确率从49.8%升至89.3%,还介绍了方法及跨模型验证情况。

PaperAgent
新闻资讯7

两个Ilya的宿命轮回:老黄10亿美金开启赛博修仙!

OpenAI花1亿美金买Torch做「数据转接头」,想让ChatGPT成全科医生;Claude用超长文本窗口处理医学文献和数据。而NVIDIA投10亿与药企建实验室,用BioNeMo重生命,开启药物生成新纪元。

新智元
算法论文8

与DeepSeek-OCR不谋而合,NeurIPS论文提出让LLM像人一样读长文本

NeurIPS 2025 论文提出 VIST 框架,为大语言模型长文本推理提供视觉方案,与 DeepSeek - OCR 理念不谋而合。它模仿人类阅读,有快 - 慢路径协作,在多任务表现优,还让模型‘用眼看文字’,优势明显。

机器之心