「LLM应用」共找到 2998 篇相关文章
总成本降低30倍,告别昂贵后训练,在线策略蒸馏敲开大模型后训练的未来
明星公司Thinking Machines由前OpenAI首席技术官联合创立,其研究团队提出在线策略蒸馏的LLM后训练方法。该方法结合在线策略训练与蒸馏优势,解决后训练两难困境,成本降30倍,还为持续学习和个性化打开新大门。
2025 的企业 AI 市场, Data &AI 占据主流视野
数据是 AI 模型学习和训练的基础,Data & AI 基础设施可打通数据与 AI 全链路。企业应用 AI 不应只关注算法和算力,还需重视私域数据。同时介绍了不同类型企业在 Data & AI 领域的特点及合作成本等内容。
谷歌将 A2A 捐赠给 Linux 基金会,但代码实现还得靠开发者自己?!
当地时间6月23日,Linux基金会宣布与多公司成立A2A项目,由谷歌捐赠协议规范等。A2A是谷歌4月推出的开放标准,支持智能体通信协作。有开发者认为它或削弱MCP地位,但谷歌称是其“补充”。实际应用有诸多问题待解。
Khosla 继 OpenAI 后的最大赌注,General Intuition 凭 38 亿个游戏高光片段做世界模型
今年10月,General Intuition完成1.34亿美元种子轮融资,由Vinod Khosla领投。它从Medal分拆,有38亿游戏短视频片段,可赋予机器“直觉和物理常识”,与LLM互补,商业化将从游戏拓展到物理世界。
重磅!DeepSeek再开源:视觉即压缩,100个token干翻7000个
DeepSeek-OCR模型探索视觉-文本压缩边界,用少量视觉token解码出10倍以上文本信息。它在OmniDocBench基准上表现超GOT-OCR2.0,为LLM长上下文问题提供方案,还能处理多类图像与近100种语言。
初探:从0开始的AI-Agent开发踩坑实录
作者分享从0开始开发AI Agent实现开源应用Helm Chart自动化生成的历程。介绍了定义角色、明确AI能力边界等开发要点,尝试三种Agent范式,还提及实践痛点如AI可观测性不足、Prompt工程困境等。
钉钉做多维表,最大的底气是自家的电商
钉钉创始人无招回归后对产品走查改造,还拆付费墙,多维表全功能免费。它类似Excel但侧重协同,借阿里电商体系优势推行业化应用,解决AI落地难题,是实用的数智化小工具。
Harness Engineering 为什么是 Agent 时代的“控制论”?
本文是 George Zhang 对 Harness engineering 的解读。OpenAI 提出新工作方式,让 agent 编码,引发讨论。从瓦特调速器到 Kubernetes 再到如今的 harness engineering,本质都是控制论模式。LLM 或使代码库反馈回路在关键决策层闭合,但校准传感器和执行器是难题。
GPT-5超越人类医生!推理能力比专家高出24%,理解力强29%
最新研究显示,GPT - 5在医疗领域处理多模态信息能力出色,在多模态测试中推理和理解得分比GPT - 4o分别提高近30%和36%,比人类医生还高。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。
发春节红包的大厂被约谈;百度O计划曝光,文心助手MAU增4倍;影石CEO回应年会送出5套房|AI周报
本周AI行业热点不断,大厂春节红包促销被约谈,百度文心助手MAU猛增4倍,影石年会豪送5套房。还有模型更新引吐槽、谷歌发债、迪士尼侵权指控等事件,也有新模型发布及企业应用新进展。