AI资讯新闻榜单内容搜索-模型训练

首次攻克「图基础模型」三大难题！港大开源OpenGraph：零样本学习适配多种下游任

港大发布通用图基座模型OpenGraph，巧妙从LLM中蒸馏零样本图泛化能力。

来自主题: AI技术研报

9479 点击 2024-03-15 12:29

为了让AI更像科学家，他们将人类知识注入大模型…

来自主题: AI技术研报

6745 点击 2024-03-15 12:21

数学问题解决能力一直被视为衡量语言模型智能水平的重要指标。通常只有规模极大的模型或经过大量数学相关预训练的模型才能有机会在数学问题上表现出色。

来自主题: AI技术研报

9128 点击 2024-03-14 16:14

大模型对齐新方法，让数学推理能力直接提升9%。

来自主题: AI技术研报

6838 点击 2024-03-13 11:10

基于大模型的Agent，已经成为了大型的博弈游戏的高级玩家，而且玩的还是德州扑克、21点这种非完美信息博弈。

来自主题: AI技术研报

4144 点击 2024-03-12 18:13

微软亚研院等发布bGPT，仍旧基于Transformer，但是模型预测的是下一个字节（byte）。

来自主题: AI技术研报

8998 点击 2024-03-11 18:04

华人科学家程博文官宣即将入职OpenAI，加入后训练团队参与多模态模型研究。值得一提的是，他还是著名华人计算机泰斗Thomas Huang的学生。

来自主题: AI技术研报

5628 点击 2024-03-11 17:44

GraphEdit方法可以有效地去除图网络中的噪声连接，还能从全局视角识别节点间的依赖关系，在不同的实验设置中都被验证为有效且稳健。

来自主题: AI技术研报

8157 点击 2024-03-11 17:34

挖掘大模型固有的长文本理解能力，InfLLM在没有引入额外训练的情况下，利用一个外部记忆模块存储超长上下文信息，实现了上下文长度的扩展。

来自主题: AI技术研报

6095 点击 2024-03-11 17:31

近年来，大语言模型（LLMs）由于其通用的问题处理能力而引起了大量的关注。现有研究表明，适当的提示设计（prompt enginerring），例如思维链（Chain-of-Thoughts），可以解锁 LLM 在不同领域的强大能力。

来自主题: AI资讯

6520 点击 2024-03-11 17:28