「学而思学习机」共找到 987 篇相关文章
DeepSeek-OCR降本增效,10×暴力压缩还能读得清
Deepseek - OCR模型发布,通过光学压缩技术解决长文本处理的计算效率问题,能控制大模型token消耗成本。介绍了其架构设计、数据引擎及训练流程,还展示其用较少token超越现有模型的能力。
当 Kafka 架构显露“疲态”:共享存储领域正迎来创新变革
沃尔玛开发者 Ankur Ranjan 与 Sai Vineel Thamishetty 长期关注 Apache Kafka 与流处理系统。文章指出 Kafka 架构现局限,介绍下一代开源项目 AutoMQ 借助云原生设计,解决其成本、扩展性与运维痛点,为实时数据流架构提供新视角。
自媒体误读了 DeepSeek-OCR:一图胜千言
近期,DeepSeek-OCR引发关注,但很多媒体误读其为OCR工具,实际是视觉语言模型。它是为大文档等场景优化的视觉压缩与识别系统,架构新颖,训练讲究,效果出色,为行业带来新思路。
创智&交大发现AI能动性新规律, 78样本胜GPT5实现软件+科研自动化
上海创智学院和上海交大刘鹏飞老师团队发现AI能动性新规律,LIMI仅用78个样本就超越GPT - 5达14.1%,提出能动性效率原则,即AI能动性不仅源于数据丰富性,更来自战略性构建,为AI系统开发开辟新路径。
华为发布如何利用RL训练强大的Deep Research Agent综述!
华为技术团队发布综述论文,首次系统性梳理利用强化学习(RL)训练强大的深度研究代理。论文指出传统SFT和DPO方法有局限,RL优势明显,还在数据构建、算法设计等方面给出进展与路线图。
开学了:入门AI,可以从这第一课开始
文章从生活小事引出AI相关知识,介绍了AI学习方法,包括掌握数学基础、编程能力,持续学习与实践。还提及AI现实挑战与机遇,回顾其发展历程,最后给学习者送上祝福与建议。
深刻理解Token:大语言模型(LLM)是如何看待这世界?
文章指出在大语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。
SOMA Robotics 陈天一:当一个追求自由的人决定跳入创业的牢笼 | 00 后创业者系列
本文讲述SOMA Robotics创始人陈天一的创业故事。他从小追求自由,休学创业,起初项目不顺,后项目入选奇绩创坛。他谈创业感受、选择具身智能赛道原因及SOMA创新等,认为创业是直面现实的修行。
OpenAI 发布了个 ChatGPT 优化计划,不是GPT-5
OpenAI未发布GPT - 5,而是推出ChatGPT「健康使用」优化计划,旨在助用户成长而非让人上瘾,措施包括休息提醒、改进生活建议功能等,还与专家合作改进响应方式。
隐藏超多上下文工程(Context Engineering)技巧的框架,来试一试吧!
文章指出多数人构建的AI Agent像Shallow Agent,处理复杂任务能力弱。以Claude Code等为例,介绍深度Agent架构的秘密,如冗长提示词、规划工具等,还推出开源包deepagents方便上手。