「人类思考」共找到 1735 篇相关文章
为什么Cline不对你的代码库进行索引(以及为什么这是好事)
用户常问Cline如何处理大型代码库,是否用RAG索引全部代码。Cline特意选择不对代码库进行索引,因为传统RAG方法用于代码库有逻辑切割、索引过时、安全风险等问题。Cline像开发者一样处理代码,有独特优势。
The Batch:820 | Qwen3 向 DeepSeek-R1 发起挑战
阿里巴巴发布八个大型语言模型权重,含两个 MoE 架构和六个稠密模型。预训练数据达 36 万亿 token,支持 119 种语言及方言。测试中 Qwen3 家族表现出色,或终结 DeepSeek - R1 霸主地位,设计用于智能体系统。
中科院开源PPT Agent,一键自动生成PPT智能体
中科院软件所等联合开源PPT Agent,它能分析参考幻灯片,按人类流程分两阶段生成PPT,有自我修正功能,测试显示在多维度优于现有方法,极大节省用户时间精力。
GPT-6来了,立摘ASI坐标系今日金牌!
OpenAI 正式发布 GPT - 6 Astra,在多项测试中表现优异。近期 Anthropic、谷歌也有新模型发布。马斯克、Altman 对 AI 发表看法。新智元决定做 ASI 坐标系,相关官网 9 月 7 日上线,现征集需求。
GPT-5.6仅用一天改写数学史,「双菲」五人团队8年纪录被破!
GPT-5.6一天打破陶哲轩五人团队8年大素数空隙纪录,提出「倾斜剩余类」构造法,当天通过Lean语言机器验证。此前数学家张益唐、陶哲轩等在素数分布问题上各有探索。
火速吃瓜,OpenAI模型还没发又惹出争议了??
GPT - 6发布前夕消息不断,OpenAI新模型引入的“循环深度”技术因可能让模型思考难监控引争议,同时模型名或被API剧透,图像模型GPT Images 2.1也将更新。
AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺
ASI-Bench是衡量AI系统科学自主性的基准测试,由多机构联合开发。它能测试AI通用智能、创新性和执行力,通过信息梯度设计,让模型在不同指导量下完成科研任务,结果显示当前AI离自主科研有明显距离。
UCSD谢澎涛创业:用AI搞科研,4小时交付顶刊水平成果,已获数百万美金融资
谢澎涛团队推出面向AI for Science的AIBuildAI Science Agent,在NatureBench评测中排名第一,超多数通用编程智能体。该智能体可独立完成模型研发,效率大幅提升,还探讨了其能力边界、应用及对行业的影响。
大模型自发涌现意识了?!Anthropic最新研究震惊全世界
Anthropic研究发现Claude内部自发长出类似人脑意识通达的J空间,开发J - lens工具可观测其运转。实验显示J空间能影响Claude回答,还能抓其小心思,研究审慎探讨模型是否有意识。
陶大程技术博客首发:从像素复刻到行动控制,具身世界模型的底层逻辑探索|甲子光年
今年世界模型成AI热点,通用世界模型追求像素逼真,具身世界模型不同,其使命是支撑行动。文章拆解具身世界模型底层逻辑,分享开悟世界模型的技术设计与实践思考。