Free CPU 在线教程 | Hermes Agent 学会长期记忆?记忆增强插件 TencentDB Agent Memory 可将事实/偏好/任务状态等分开存储

6 月 1 日
阅读 5 分钟
2k
过去一年,AI Agent 的发展速度远超预期。从能够理解自然语言的聊天机器人,到能够自主调用工具、执行复杂任务的智能代理,大语言模型正逐渐摆脱「问一句答一句」的被动交互模式,开始向真正意义上的数字员工演进。然而,当 Agent 被投入到真实工作场景后,一个关键瓶颈也迅速浮现:它们往往缺乏持续记忆与经验积累能力。
封面图

字节开源 Lance,3B 模型包揽理解/生成/编辑;新加坡国立大学提出 ViMU 数据集:涵盖 588 个视频与无提示问答

5 月 29 日
阅读 4 分钟
2k
Lance 是字节跳动于 2026 年发布的原生统一多模态模型,采用 3B 活动参数设计,可在单一框架内同时完成图像与视频的理解、生成和编辑。该模型通过统一多模态表示与多任务协同训练,实现文本、图像和视频任务之间的能力共享。其核心采用双流混合专家(MoE)架构与模态感知旋转位置编码(MaPE),在共享的交错多模态序列上...
封面图

论文汇总 | 大模型强化学习最新进展,微软/谷歌/斯坦福/人大/小红书等发布信用分配/复杂推理/智能体强化学习重磅成果

5 月 28 日
阅读 4 分钟
1.8k
纵观当前强化学习领域的发展,无论是提升长链路推理中的信用分配能力,增强模型在复杂环境中的自主探索,还是构建具备长期规划与反馈学习能力的智能体系统,其核心目标都指向同一个方向——突破稀疏奖励与静态监督的限制,赋予模型通过交互持续学习与自我进化的能力。
封面图

自主生成新型材料,科学家基于贝叶斯优化框架实现含镓材料反向设计,优化结果具有 100% 独特性和新颖性

5 月 27 日
阅读 5 分钟
1.9k
在现代半导体产业中,材料性能的边界正在被不断推向更高维度。从高效光伏器件到高亮度发光二极管(LED),再到高频通信与量子信息系统,几乎所有关键技术的底层,都依赖于一种核心能力——对材料电子结构的精确调控,尤其是对带隙(band gap)的精准设计。然而,这一目标在传统材料科学体系中长期难以实现。
封面图

30 分钟整合 550 篇文献,生物学多智能体 Robin 跑通自主科研闭环,挖掘 dAMD 候选疗法

5 月 26 日
阅读 5 分钟
1.9k
随着生物检测、扰动实验与计算建模技术不断成熟,生命科学研究的精度与规模正在迅速提升。然而,与高速增长的数据生产能力相比,科研体系在知识整合与科学推理层面的智能化能力却明显滞后。海量有效信息分散在论文、数据库与实验结果之中,依赖人工梳理不仅效率低,也难以跨领域关联已有结论,导致许多已经被验证的发现...
封面图

零代码自主发现科学图像处理算法,美阿贡国家实验室提出 CVEvolve,具备写代码/结果自查/策略优化等全栈能力

5 月 25 日
阅读 5 分钟
1.9k
一项客观严谨的科学结论的得出,犹如沙海淘金一般困难。尤其在大量先进科学仪器与模拟仿真技术全面普及的当下,科研产出的数据体量庞大、结构松散且高度非结构化,科研数据处理的过程恰似披沙拣金,已然成为解锁数据价值、揭示科研真相前最关键、最核心的一环。
封面图

全新生图模型 Anima V1 发布:专注动漫风格的图像生成;MemLens 多模态长程记忆评估数据集:涵盖跨会话图文推理与知识更新机制

5 月 22 日
阅读 4 分钟
2.5k
Anima V1 是 CircleStone Labs 于 2026 年发布的动漫风格图像生成模型,专为角色立绘、插画等二次元视觉创作打造。通过文本 Prompt 描述人物细节与光影,即可快速输出精美图像。借助项目集成的 Gradio 交互界面,开发者可以告别繁琐的纯脚本调用,直接在浏览器中调节尺寸、采样步数、 CFG 等关键参数,更完美地适配角色...
封面图

谷歌全球洪水预报系统最新升级,v2 版本可靠预报时长延长 6 天,精度全面提升

5 月 21 日
阅读 5 分钟
2.3k
洪水是全球影响最广、危害最深的自然灾害之一。河流径流能否被准确预测、洪水预警能否及时发布,直接关系到流域防灾减灾能力、生态安全以及社会经济运行的稳定性。也正因如此,水文学长期以来始终将「如何更准确地预测洪水」视为核心问题之一。
封面图

Free CPU 教程丨狂揽 8.8k stars,TTS 模型 Supertonic-3 参数规模仅约 99M,支持 31 种语言

5 月 20 日
阅读 3 分钟
2.4k
在生成式 AI 持续向多模态方向演进的背景下,TTS 正在从「云端能力」逐渐转向「本地能力」。过去,高质量 TTS 系统往往依赖大型模型、云端推理和复杂部署流程,这虽然能够提供自然的语音效果,却也带来了延迟、成本与隐私方面的问题。尤其是在移动设备、浏览器、边缘硬件等场景中,如何以更低资源消耗实现实时、高质量、...
封面图

小样本生物医学研究新突破,德国团队基于生成式 AI 模型实现数据增强,或减少 30-50% 实验动物用量

5 月 19 日
阅读 4 分钟
2.2k
动物实验中验证的「有效疗效」,进入临床阶段后却屡屡难以复现,样本量不足是核心根源之一。受伦理规范、实验成本与研究条件的多重限制,生物医学临床前研究往往难以开展大样本动物实验,这直接导致统计检验效力不足,研究者既无法稳定提取真实的生物学信号,又极易陷入假阳性结果的陷阱,严重阻碍基础研究向临床应用的...
封面图

速度提升 252 倍,斯坦福/UCLA 等用 LSTM 将二阶非线性光学仿真带入毫秒级时代

5 月 18 日
阅读 4 分钟
2.1k
二阶非线性光学是非线性光学里最重要、应用最广泛的核心分支,主要研究强激光与无中心反演对称的特殊光学晶体相互作用时,由二阶非线性极化率 χ⁽²⁾ 主导的光学效应。简单来说,当高强度激光射入这类晶体,光子会发生「能量合并和频率重组」,直接产生全新频率、全新颜色的光束,实现倍频(Second-harmonic generation,S...
封面图

腾讯开源 Hy-MT1.5 翻译模型:440MB 跑出顶级翻译能力;MIT 联合发布 MathNet:涵盖 2.7 万道奥数真题的多模态数学推理基准

5 月 18 日
阅读 6 分钟
2.5k
Hy-MT1.5-1.8B-1.25bit 是腾讯推出的轻量级机器翻译模型,基于 Hy-MT1.5-1.8B 构建,通过 MT 预训练、监督微调、蒸馏与强化学习等多阶段训练优化而成。模型支持 33 种语言、 5 种方言及少数民族语言,以及 1,056 个翻译方向。在仅有 18 亿参数的情况下,其翻译效果已超过部分更大规模开源模型与主流商业翻译 API 。
封面图

精确率达 94%,西班牙团队基于 YOLO11 实现自动化近地天体与卫星条纹检测,连续帧之间稳定识别

5 月 14 日
阅读 3 分钟
2.1k
探测近地天体,不仅能帮助人们理解太阳系的形成与演化,也与行星防御直接相关。按照国际天文学界的定义,近地天体是轨道近日点小于 1.3 天文单位、与地球轨道接近或相交的小行星。正因为轨道靠得近,它们成了防撞监测的重点对象。
封面图

在线教程丨单卡即可爆改,面壁智能等开源 MiniCPM-V-4.6,1.3B 端侧模型支持图像理解/视频理解/OCR/多轮多模态对话

5 月 13 日
阅读 3 分钟
2.3k
过去几年,整个 AI 行业几乎都笼罩在 Scaling Law 的叙事之下。参数越大、训练数据越多,模型似乎就越接近「通用智能」。从千亿到万亿参数,大模型不断刷新人们对推理能力与世界知识的想象,也让「堆算力、卷规模」成为行业默认的发展路径。
封面图

百所高校展开全球最大规模多队列蛋白质基因组学研究,基于近 8 万受试者数据解锁致病基因与老药新用

5 月 12 日
阅读 6 分钟
2.4k
人类基因组就像一本完整的生命说明书,记录着长相、身高、体质、疾病风险等所有遗传信息。但说明书的解密过程并不是按部就班的,期间很可能出现多种「小意外」,其中就包括让人容易患某种疾病的致病变异。更棘手的是,大多数致病变异位于基因组中「不直接编码蛋白质」的非编码区域,这种到底是哪个基因、通过什么机制致...
封面图

Token 使用量降低 30%,以「阿凡达」为灵感的异构智能体框架 Eywa,高效结合语言模型与领域专用基础模型

5 月 11 日
阅读 4 分钟
2.3k
过去几年,Agentic AI(智能体 AI)几乎成为人工智能领域最重要的演进方向之一。从自动编程、知识检索到任务规划,大语言模型(LLM)正从「聊天机器人」逐渐演化为具备自主推理、行动与协作能力的智能体系统。但一个越来越明显的问题也正在浮现——几乎所有主流智能体系统,本质上仍是「语言中心化」的系统。无论是任务规...
封面图

论文周报丨 ProgramBench 让 AI 从零写软件,9 大模型集体翻车;无需额外真实世界数据,ExoActor 展现强场景泛化能力……速览一周 AI 前沿论文

5 月 9 日
阅读 5 分钟
2.6k
随着语言模型逐渐被用于长期软件开发,现有基准测试已难以衡量模型在系统架构设计、模块划分和整体工程实现方面的表现。为此,SWE-Bench 团队提出了 ProgramBench 基准:仅向模型提供程序可执行文件和使用文档,要求其重新编写代码并复现程序行为。
封面图

在线教程丨指令遵循/推理/编码三合一,Mistral Medium 3.5 把 Coding Agent 搬上云端

5 月 8 日
阅读 3 分钟
2.5k
随着 AI Agent 能力持续进化,大模型正在从「对话助手」逐渐变成真正能够执行任务的智能系统。近期,Mistral AI 发布的 Mistral Medium 3.5 再次将 AI Coding Agent 推向新的阶段。相比传统只能完成简单代码补全的编程助手,其已经能够在云端独立运行、并行处理任务,并持续完成复杂的软件开发流程,包括代码生成、调试...
封面图

平均 1.8 秒完成预测,MIT 等开发 GPU 功耗估算框架 EnergAIzer,误差约 8%

5 月 6 日
阅读 5 分钟
2.6k
据劳伦斯伯克利国家实验室估计,由于人工智能的爆炸式增长,到 2028 年,数据中心将消耗美国总用电量的 12% 。作为 AI 工作负载的主要加速器,图形处理器(GPU)已成为功耗的主要来源,其热设计功耗(TDP)在最新的 NVIDIA H100 和 GB200 中分别达到 700W 和 1200W 。在能源挑战日益严峻的背景下,针对 AI 工作负载快速...
封面图

在线教程丨高性能与易部署兼得,DeepSeek-V4-Flash模型参数284B,简单任务可媲美1.6T Pro版模型

4 月 30 日
阅读 3 分钟
3.6k
近期开源的 DeepSeek V4 不负众望,在 Agent 能力、推理和世界知识方面站在了开源模型的领头羊位置。这次沉寂已久的更新带来了两个不同版本——DeepSeek-V4-Pro 和 DeepSeek-V4-Flash,可谓是一则探寻能力天花板,另一则强调工程落地与效率优化。
封面图

本地可跑的隐私检测模型:Privacy Filter 低成本实现高质量 PII 过滤;硬核开源!涵盖超 8 万场比赛的 Transfermarkt 结构化足球数据集

4 月 30 日
阅读 4 分钟
2.7k
Privacy Filter 是 OpenAI 开源的一款专为高吞吐量数据清理打造的双向标记分类模型,用于高效检测和屏蔽文本中的个人身份信息 (PII) 。它基于类似 gpt-oss 的小型预训练架构改造而成,摒弃了传统的逐词生成方式,而是通过一次前向传播结合约束维特比算法,直接对输入序列进行连贯的片段解码。
封面图

在线教程丨狂揽41k stars,港大团队开源超轻量AI助手nanobot,4000行代码实现OpenClaw核心功能

4 月 28 日
阅读 3 分钟
2.6k
横空出世的 OpenClaw 将大语言模型从单一的对话工具,推进为具备持续在线、多平台交互、工具调用与任务执行能力的「数字员工」。然而,其超过 40 万行的代码规模,也让不少开发者在学习与二次开发时望而却步。

在线教程丨狂揽 41k stars,港大团队开源超轻量 AI 助手 nanobot,4000 行代码实现 OpenClaw 核心功能

4 月 28 日
阅读 3 分钟
2.6k
横空出世的 OpenClaw 将大语言模型从单一的对话工具,推进为具备持续在线、多平台交互、工具调用与任务执行能力的「数字员工」。然而,其超过 40 万行的代码规模,也让不少开发者在学习与二次开发时望而却步。
封面图

利用堆叠集成学习,英国研究团队实现251颗盾牌座δ型星星震学指数高精度预测

4 月 27 日
阅读 3 分钟
2.3k
星震学通过解析恒星的天然振荡信号,反演其内部结构与演化状态,是现代恒星物理中最具穿透力的研究手段之一。在众多研究对象中,盾牌座 δ 型星(质量约为太阳的 1.5–2.5 倍)因其丰富的脉动模式和高度密集的振荡频谱,成为星震学的重要实验场。这类恒星的脉动主要源于氦电离区的不透明度(κ)机制驱动,而其内部对流核则...
封面图

利用堆叠集成学习,英国研究团队实现 251 颗盾牌座δ型星星震学指数高精度预测

4 月 27 日
阅读 3 分钟
2.4k
星震学通过解析恒星的天然振荡信号,反演其内部结构与演化状态,是现代恒星物理中最具穿透力的研究手段之一。在众多研究对象中,盾牌座 δ 型星(质量约为太阳的 1.5–2.5 倍)因其丰富的脉动模式和高度密集的振荡频谱,成为星震学的重要实验场。这类恒星的脉动主要源于氦电离区的不透明度(κ)机制驱动,而其内部对流核则...
封面图

在线教程丨小身材大「码」力,Qwen3.6-27B编程能力达旗舰级

4 月 24 日
阅读 2 分钟
2.9k
4 月 22 日,继 Qwen3.6-35B-A3B 开源后,Qwen 团队带来了该系列模型中社区呼声更高的版本——Qwen3.6-27B 。这个拥有 270 亿参数的稠密多模态模型,支持多模态思考与非思考模式,在智能体编程方面达到了「旗舰级」表现。具体而言,Qwen3.6-27B 在 WE-bench Verified(77.2 vs. 76.2)、 SWE-bench Pro(53.5 vs. 50.9)、...
封面图

极致轻量,画质不减!ERNIE-Image-Turbo:告别漫长等待,速度快到飞起;引入感知与认知双维指标:阿里多模态统一解析评估数据集 OmniParsingBench 上线

4 月 24 日
阅读 5 分钟
2.6k
ERNIE-Image-Turbo 是由百度开源的一款高效文生图模型。它基于单流扩散变换器(DiT)架构,并经过 DMD 与 RL 技术的深度优化,仅需 8 个推理步骤即可快速生成高保真、高美观度的图像。凭借出色的轻量化设计,大幅降低了应用和研究的硬件门槛。
封面图

在线教程丨小身材大「码」力,Qwen3.6-27B 编程能力达旗舰级

4 月 24 日
阅读 3 分钟
3.3k
4 月 22 日,继 Qwen3.6-35B-A3B 开源后,Qwen 团队带来了该系列模型中社区呼声更高的版本——Qwen3.6-27B 。这个拥有 270 亿参数的稠密多模态模型,支持多模态思考与非思考模式,在智能体编程方面达到了「旗舰级」表现。
封面图

ICLR 2026 丨单任务可训练参数减少 125 倍!新方法 Task Tokens 助力具身智能提升复杂任务能力

4 月 23 日
阅读 5 分钟
2.5k
近年来,机器人控制领域模仿学习的进展催生了基于 Transformer 的行为基础模型(Behavior Foundation Models, BFMs),该模型能够实现类人智能体的多模态控制。这些模型在给定高级目标或提示的情况下生成解决方案,例如,在给定机器人骨盆位置的情况下,引导机器人走到某个坐标。尽管 BFM 在零样本生成稳健行为方面表现...
封面图

数据集汇总丨从医疗影像/临床数据,到细胞图谱/医学问答,10 大数据集覆盖多类疾病场景

4 月 22 日
阅读 4 分钟
2.4k
在 AI 加速向医疗领域渗透的当下,高质量数据集正逐渐成为驱动模型性能提升与应用落地的核心基础。从医学影像识别到临床决策支持,再到生物机制解析,数据的类型、规模与标注精度,直接决定了模型能力的上限与应用边界。
封面图