来源丨新智元 AI co-scientist系统基于Gemini 2.0开发,能够协助科研人员生成新的研究假设、制定实验方案,并通过自我改进提升结果质量。在生物医学应用中,AI co-scientist成功预测了药物再利用方向、提出新的治疗…
声浪
来源丨量子位 近日,豆包语音模型基于原有Seed-TTS框架进一步加入上下文理解,实现了高表现力、高自然度、高语义理解的小说演播效果。 无需额外标签,端到端合成声音 市面上很多的语音模型已经能保证足够自然的合成表现,但在音质、韵律、情感,以…
月之暗面(Moonshot AI)是此前中国大模型企业中非常受关注的一家企业。旗下的Kimi大模型和产品因为强悍的性能、超长的上下文以及非常快速的响应引起了广泛的关注。不过,此前MoonshotAI的策略一直是闭源模型,但是产品免费。也许是…
CLaMP 3,作为一款多模态、多语言的音乐信息检索框架,为音乐爱好者、创作者、教育者以及研究者们带来了全新的体验与可能。本文将深入剖析CLaMP 3的技术原理、核心功能、应用场景,带你全面了解这一创新框架。 项目官网:https://sa…
来源丨机器之心 DeepSeek-R1 非常热门,而在其公布的训练配方中,GRPO(Group Relative Policy Optimization)非常关键,是 DeepSeek-R1 核心的强化学习算法。 PPO 与 GRPO 的对…
DeepSeek 旋风席卷全球,其独有的深度思考+联网模式让用户纷纷惊叹好用,如果你想脱离与 AI 的文字互动,与 DeepSeek 进行更具真实感的语音对话,声网的对话式 AI 引擎仅15分钟内就能做到。 近日,声网对话式 AI 引擎 B…
来源丨机器之心 今天凌晨2点,OpenAI开源了一个全新评估大模型代码能力的测试基准——SWE-Lancer。 开源地址:https://github.com/openai/SWELancer
来源丨新智元 刚刚,中国首个AI短剧视频生成模型——SkyReels-V1正式开源,千万级好莱坞数据训练微调。更震撼的是,首个SOTA级表情动作可控算法同时开源,每一个表情,每一个肢体动作,AI精准掌控。 今天,昆仑万维开源中国首个面向AI…
今天,Sam Altam在推特上说明了OpenAI未来的大模型路线图。比较重磅的消息是即将在未来几周发布GPT-4.5,并且在几个月后发布GPT-5。 OpenAI即将发布两个版本的大模型,分别是GPT-4.5和GPT-5 GPT-4.5是…
来源丨新智元 今天,文心一言重磅宣布4月1日起全免费!还同步上线了深度搜索功能,它能自主调用多种工具,给出专业级解答。让我们上手亲测考考它! 就在刚刚,百度官宣,4月1日起文心一言全免费,全网瞬间沸腾。接下来,所有PC端和APP端用户,均可…
