阿里与上交大提出 LLM 长文本计算新解法:可处理文本长达 1900k 字节、效率提升 2.4 倍

阿里与上交大提出 LLM 长文本计算新解法:可处理文本长达 1900k 字节、效率提升 2.4 倍

编译 | 郭 思编辑丨陈彩娴在实际应用大模型的过程中,尤其是处理长文本的上下文信息时,如何高效灵活地调度计算资源成为一个学术界与工业界共同关注的问题。大语言模型所能容纳的上下文长度直接影响了诸如 Ch
体育中考「上难度」,视觉 AI 下场「减负」

体育中考「上难度」,视觉 AI 下场「减负」

“组织体育中考30年了,今年是第一年没有遇到12345投诉的考试。”“监考17年,第一次能准点吃饭,提前下班。”上面这些评价,来自今年北京市部分体育中考考场裁判老师。每年3月到5月,是各地学校组织体育
独家丨前微软 NLP 大牛姜大昕创立新公司「阶跃星辰」

独家丨前微软 NLP 大牛姜大昕创立新公司「阶跃星辰」

AI 科技评论独家获悉:前微软 NLP 技术大牛姜大昕离职后创业,成立了一家大模型公司——阶跃星辰。根据爱企查信息显示,阶跃星辰成立于 2023 年 4 月 6 日,姜大昕任执行董事和经理,朱亦博任监
大模型「点火」,AI for Science 提速

大模型「点火」,AI for Science 提速

在生产环节中,95% 是一个分水岭。以人为对照标准,人工的准确率在 92% 至 98% 之间,因此,行业对机器容忍度的判别标准取之中位数,未达到 95% 的部分,无论是 80% 乃至 90% 的准确率
大模型「点火」,AI for Science 提速

大模型「点火」,AI for Science 提速

在生产环节中,95% 是一个分水岭。以人为对照标准,人工的准确率在 92% 至 98% 之间,因此,行业对机器容忍度的判别标准取之中位数,未达到 95% 的部分,无论是 80% 乃至 90% 的准确率
通用3D机器视觉平台是不是伪命题?

通用3D机器视觉平台是不是伪命题?

机器视觉是工业制造向“智造”升级的重要一环。从技术发展的趋势看,工业机器视觉正在经历从2D到3D的蝶变。3D视觉的价值在于,多一维度的信息数据主要是空间坐标),能满足对体积、形状、距离等信息测量的需要
被低估的面壁:打造出不输 OpenAI 的 Scaling Law 曲线

被低估的面壁:打造出不输 OpenAI 的 Scaling Law 曲线

大约 1 个月前,马斯克所创办的 xAI 团队宣布开源 Grok-1——一个参数量为 3140 亿的 MoE 大模型。从参数量来看,Grok-1 超越了 70B 的 LLaMA 2,是当前开源模型中最
Gair 大咖说:AI 的兴起是否意味着 Web3 的衰落?

Gair 大咖说:AI 的兴起是否意味着 Web3 的衰落?

AI呼啸而过,站在路边的Web3随风飞扬。AI的兴起是否会带来Web3的衰落?2023,ChatGPT爆火,AIGC一时风生水起。每一天,关于AI、大模型的消息不绝于耳,Capilot新版Office
《太奶奶》爆火助推李柯以升咖“短剧一姐”,听花岛成大咖制造机

《太奶奶》爆火助推李柯以升咖“短剧一姐”,听花岛成大咖制造机

来源标题:《太奶奶》爆火助推李柯以升咖“短剧一姐”,听花岛成大咖制造机作为国内精品短剧第一厂牌,听花岛在6月推出的《十八岁太奶奶驾到,重整家族荣耀》简称《太奶奶》)堪称战略落地的范本,以黑马之姿刷新了
智谱AI狂飙:与商业化博弈的一年

智谱AI狂飙:与商业化博弈的一年

【雷峰网(公众号:雷峰网)】“这一年时间过得太快了。”2023 年 12 月 AI 科技评论在搜狐网络大厦见到智谱AI COO 张帆时,张帆如是说。张帆在 2023 年 3 月加入中国大模型领域“当红
对话加拿大工程院于非院士:寻找 AI 领域的「香农定理」

对话加拿大工程院于非院士:寻找 AI 领域的「香农定理」

当科学家把一些菟丝子移植到几株营养状态不同的山楂树上时,那些营养状况更好的山楂树会更容易获得菟丝子的「青睐」。这在以往被看作是植物内「被动」存在的东西,但据研究人员发现,植物也具备从过去的经验中学习区
共襄学术盛宴,共话产业发展,2024中国图象图形大会在西安圆满落幕

共襄学术盛宴,共话产业发展,2024中国图象图形大会在西安圆满落幕

2024年5月24-26日,中国图象图形大会CCIG 2024)在西安隆重召开。本次大会由中国图象图形学学会主办,空军军医大学、西安交通大学、西北工业大学承办,陕西省生物医学工程学会、陕西省图象图形学
多模态AI技术「涌现」,AI公司的「新机会」

多模态AI技术「涌现」,AI公司的「新机会」

ChatGPT-4的横空出世,让AI行业再一次柳暗花明。某AI企业人士如此评价GPT-4的进步:“GPT-3或3.5像一个六年级学生,而GPT-4像一个聪明的十年级学生。”即将毕业的小学生与新晋高中生
在 AI 战场里拿掉英特尔,PC 能活吗?

在 AI 战场里拿掉英特尔,PC 能活吗?

ChatGPT引发了一场大模型淘金热。一开始大家扎堆训练大模型。发现入局没有那么简单,发展到第二阶段,就开始出现了寄生于ChatGPT的众多APP和应用。无论是发力于向量数据库缓存,还是支持模型微调以
谁将替代 Transformer?

谁将替代 Transformer?

【雷峰网(公众号:雷峰网)】2017年谷歌发表的论文《Attention Is All You Need》成为当下人工智能的一篇圣经,此后席卷全球的人工智能热潮都可以直接追溯到 Transformer
国内首个医疗专科推理数据集开源,蚂蚁百灵大模型助力行业落地

国内首个医疗专科推理数据集开源,蚂蚁百灵大模型助力行业落地

12月28日,由信通院主办的“虹桥之源”大模型驱动数字经济新生态峰会在上海召开。会上,蚂蚁集团商业机器智能部总经理顾进杰介绍蚂蚁正式开源国内首个医疗专科推理数据集,这将有助于提升大模型在医疗领域的专业
SCOW 首次亮相 HPC China 2022,以算网融合助力“东数西算”工程发展

SCOW 首次亮相 HPC China 2022,以算网融合助力“东数西算”工程发展

12月13日,以“新算力 新赋能 新未来”为主题的2022 CCF全国高性能计算学术年会CCF HPC China 2022)在线上正式召开。作为高性能计算领域全球最具影响力的三大超算盛会之一,大会邀
独家|杨红霞创业入局“端侧模型”,投后估值 1.5 亿美元

独家|杨红霞创业入局“端侧模型”,投后估值 1.5 亿美元

近日,关于字节跳动大语言模型研发技术专家杨红霞离职创业的事情,坊间传得沸沸扬扬。雷峰网独家获悉,杨红霞已于 5 月下旬正式从字节跳动离职,开始筹备 AI 创业项目。不过,杨红霞不做“大”模型,而是将方
牵手五大顶尖高校教授   “云阙智能”打造AIGC智囊团

牵手五大顶尖高校教授 “云阙智能”打造AIGC智囊团

大模型竞争已进入白热化阶段,盲目卷资源已不再是长久之计,AI 创业公司的可持续性和科学性则是更重要的考量因素。在这一背景下,背靠强大高校,有科研能力、学术资源和充足的后备人才作为补充,变得愈发重要。2
大模型时代的三道鸿沟:数据、成本与想象力

大模型时代的三道鸿沟:数据、成本与想象力

跨入2023年,大模型兴起、诸多公司「跑步进场」的头几个月,大模型一边倒向 C 端类 ChatGPT 的研发,对成本、效率更敏感的企业客户似乎不在关注焦点。然而近两个月,情况发生了变化。基于医疗、金融