AI资讯新闻榜单内容搜索-数据

AITNT-国内领先的一站式人工智能新闻资讯网站
# 热门搜索 #
搜索: 数据
如何从零开始训练大模型(minicpm分享&讨论)

如何从零开始训练大模型(minicpm分享&讨论)

如何从零开始训练大模型(minicpm分享&讨论)

根据scaling law,模型越大,高质量数据越多,效果越好。 但还有一个很直观的情况,随着预训练样本的质量不断提升,训练手段的优化。新的模型,往往效果能轻松反超参数量两倍于它的模型。

来自主题: AI技术研报
4030 点击    2024-03-19 15:55
如何把大量物理知识塞给AI?EIT和北大团队提出「规则重要性」概念

如何把大量物理知识塞给AI?EIT和北大团队提出「规则重要性」概念

如何把大量物理知识塞给AI?EIT和北大团队提出「规则重要性」概念

深度学习模型因其能够从大量数据中学习潜在关系的能力而「彻底改变了科学研究领域」。然而,纯粹依赖数据驱动的模型逐渐暴露出其局限性,如过度依赖数据、泛化能力受限以及与物理现实的一致性问题。

来自主题: AI技术研报
8889 点击    2024-03-18 20:24
没等来OpenAI,等来了Open-Sora全面开源

没等来OpenAI,等来了Open-Sora全面开源

没等来OpenAI,等来了Open-Sora全面开源

不久前 OpenAI Sora 以其惊人的视频生成效果迅速走红,在一众文生视频模型中突出重围,成为全球瞩目的焦点。继 2 周前推出成本直降 46% 的 Sora 训练推理复现流程后,Colossal-AI 团队全面开源全球首个类 Sora 架构视频生成模型 「Open-Sora 1.0」,涵盖了整个训练流程,包括数据处理、所有训练细节和模型权重,携手全球 AI 热爱者共同推进视频创作的新纪元。

来自主题: AI技术研报
5641 点击    2024-03-18 17:25
OpenAI再陷巨大争议?Sora训练数据被质疑非法,CTO采访疯狂翻车

OpenAI再陷巨大争议?Sora训练数据被质疑非法,CTO采访疯狂翻车

OpenAI再陷巨大争议?Sora训练数据被质疑非法,CTO采访疯狂翻车

最近,OpenAI CTO Murati接受采访时,对Sora训练数据语焉不详、支支吾吾的表现,已经成了全网热议的话题。毕竟,要是一个处理不好,OpenAI就又要陷入巨额赔偿金的诉讼之中了。

来自主题: AI资讯
2925 点击    2024-03-16 15:18
Zephyr AI完成1.11亿美元A轮融资,AI+精准医疗技术获礼来支持

Zephyr AI完成1.11亿美元A轮融资,AI+精准医疗技术获礼来支持

Zephyr AI完成1.11亿美元A轮融资,AI+精准医疗技术获礼来支持

Zephyr AI是一家总部位于美国德克萨斯州的医疗保健技术公司,致力于开发数据联合工具以及肿瘤和心血管代谢疾病领域的各种机器学习算法,尝试重塑药物发现和精准医疗。

来自主题: AI资讯
3325 点击    2024-03-16 11:56
a16z全球AI产品Top100:22家新公司上榜、音乐和生产力工具崛起、AI陪伴产品成为主流

a16z全球AI产品Top100:22家新公司上榜、音乐和生产力工具崛起、AI陪伴产品成为主流

a16z全球AI产品Top100:22家新公司上榜、音乐和生产力工具崛起、AI陪伴产品成为主流

六个月前,a16z 对网络流量数据进行了一次深度挖掘,以便将真实数据与其他内容区分开来。根据每月访问量,a16z 对最受欢迎的生成式 AI 网络产品进行了排名,并发现了消费者实际使用这项技术的模式。

来自主题: AI资讯
9769 点击    2024-03-16 11:42
开源版“Devin”AI程序员炸场:自己分析股票、做报表、建模型

开源版“Devin”AI程序员炸场:自己分析股票、做报表、建模型

开源版“Devin”AI程序员炸场:自己分析股票、做报表、建模型

GitHub三万Star项目MetaGPT上新,号称是“开源Devin”——推出数据解释器(Data Interpreter),能够应对数据实时变化、任务之间复杂的依赖关系、流程优化需求以及执行结果反馈的逻辑一致性等挑战。

来自主题: AI资讯
6617 点击    2024-03-16 11:30
何恺明刘壮新作:消除数据集偏差的十年之战

何恺明刘壮新作:消除数据集偏差的十年之战

何恺明刘壮新作:消除数据集偏差的十年之战

MIT新晋副教授何恺明,新作新鲜出炉:瞄准一个横亘在AI发展之路上十年之久的问题:数据集偏差。数据集偏差之战,在2011年由知名学者Antonio Torralba和Alyosha Efros提出——

来自主题: AI技术研报
5488 点击    2024-03-16 11:24
仅需200M参数,零样本性能超越有监督!谷歌发布时序预测基础模型TimesFM

仅需200M参数,零样本性能超越有监督!谷歌发布时序预测基础模型TimesFM

仅需200M参数,零样本性能超越有监督!谷歌发布时序预测基础模型TimesFM

TimesFM针对时序数据设计,输出序列长于输入序列,在1000亿时间点数据进行预训练后,仅用200M参数量就展现出超强零样本学习能力!

来自主题: AI技术研报
6318 点击    2024-03-15 15:42
刷榜「代码生成」任务!复旦等发布StepCoder框架:从编译器反馈信号中强化学习

刷榜「代码生成」任务!复旦等发布StepCoder框架:从编译器反馈信号中强化学习

刷榜「代码生成」任务!复旦等发布StepCoder框架:从编译器反馈信号中强化学习

StepCoder将长序列代码生成任务分解为代码完成子任务课程来缓解强化学习探索难题,对未执行的代码段以细粒度优化;还开源了可用于强化学习训练的APPS+数据集。

来自主题: AI技术研报
6801 点击    2024-03-15 15:38