思维方式」共找到 1069 篇相关文章

新闻资讯7

张小珺采访了Kimi杨植麟,Agent泛化的临界点来了。

张小珺采访Kimi杨植麟,杨分享技术见解。如Scaling Law遇瓶颈,应提升Token效率;Adam与Muon对比,Muon学习效率高;模型公司下场做一方Agent产品,垂直整合模式上限高;还谈及长上下文、Agent训练及管理方式等问题。

探索AGI
推荐文章7

LLM提示三剑客:解密CoT、ReAct、DSP如何提升AI准确率?

LLM提示分思维链(CoT)、ReAct和声明式自我提示(DSP)三类。CoT鼓励模型推理,适合多步骤复杂问题;ReAct结合推理与动作,是代理基础;DSP让模型声明计划,用于模块化任务。还给出使用场景与对比。

CourseAI
产品应用7

新DeepSeek R1代码能力直逼Claude 4!附生成任何优质网站的通用提示词

作者体验DeepSeek R1超8小时,发现其文本写作问题大幅修复,思维链推理改进,代码能力提升,前端审美直逼Claude 4。文章展示其前端能力,给出写前端网页提示词及设计逻辑,还探讨了其在复杂任务中的表现。

花叔
新闻资讯7

特斯拉OpenAI数据路线遇挫!8千平具身「兵工厂」+ego众包狂飙

2024年特斯拉和OpenAI在机器人数据采集上路线不同,前者重资产高精度,后者低成本众包。当前数据采集方式各有优劣,难以兼顾质量与成本。数据堂提出分层采集架构,通过场内工厂化和场外众包化双轮驱动解决难题。

新智元
开源动态7

浏览器自动化:从GUI到OpenCLI

文章讲述放弃不稳定的前端UI自动化操作,采用解析并复现底层API请求的方式,来解决浏览器自动化的效率与稳定性难题。介绍了OpenCLI思路、使用方法、原理,还提及自动生成CLI及应用案例,指出未来软件竞争维度将转向可调用性。

阿里云开发者
推荐文章8

GPU-MODE Leaderboards之nvfp4_gemv代码阅读

文章围绕GPU-MODE的nvfp4_gemv竞赛rank1代码展开,先介绍问题及官方baseline,后详细解读rank1代码,含数据加载、线程模型等,还剖析核心计算函数,最后总结代码在缓存控制、数据格式等方面的调优亮点。

GiantPandaLLM
推荐文章8

退隐3年后回归,周末写的AI一夜刷屏、一周拿下10万Star增速超Linux,Clawdbot之父首次长谈:如今几乎不看自己发布的代码

本文是对OpenClaw开发者Peter Steinberger的深度专访。他曾打造PSPDFKit,隐退三年后回归,用大模型工具开发出OpenClaw。他分享了开发历程、工作方式,探讨AI对编程的影响,还指出大公司采用AI的难点及对开发者的建议。

AI科技大本营
开源动态8

社区供稿丨Jina-VLM:可在笔记本上跑的多语言视觉小模型

Jina AI发布2.4B参数量的视觉语言模型Jina - VLM,在多语言视觉问答任务达SOTA。它引入注意力池化,连接视觉与语言基座,处理问答等任务,对硬件要求低,多项测试表现优,还介绍架构、训练策略和上手方式

Hugging Face
新闻资讯8

Linux之父又开喷:AI泡沫“病态扭曲、迟早暴跌”、马斯克式KPI“愚蠢到不该待在科技圈”

Linus Torvalds 在节目中谈诸多话题。他认为 AI 是泡沫且市场叙事病态,迟早暴跌,但也会改变社会和工作方式;不认同用代码行数衡量绩效,称此举愚蠢。还谈了对 Linux、Git、微软等看法,以及装机细节。

InfoQ
新闻资讯8

陶哲轩用GPT5-Pro跨界挑战!3年无解的难题,11分钟出完整证明

陶哲轩与GPT - 5 Pro合作解决微分几何领域3年未解难题。GPT - 5 Pro从计算到证明一气呵成,助陶哲轩突破思维局限。陶哲轩认为AI在小、大尺度上有用,中尺度无益,还印证多尺度衡量工具有效性观点。

量子位