文章导航PC6首页软件下载单机游戏安卓资源苹果资源

pc软件新闻网络操作系统办公工具编程服务器软件评测

安卓新闻资讯应用教程刷机教程安卓游戏攻略tv资讯深度阅读综合安卓评测

苹果ios资讯苹果手机越狱备份教程美化教程ios软件教程mac教程

单机游戏角色扮演即时战略动作射击棋牌游戏体育竞技模拟经营其它游戏游戏工具

网游cf活动dnf活动lol周免英雄lol礼包

手游最新动态手游评测手游活动新游预告手游问答

您的位置:首页单机游戏角色扮演 → 怪物猎人世界新装备介绍 怪物猎人世界新装备新系统一览

极品飞车

Chinese scientists develop electrode coating to address signal loss and tissue adhesion problems in long-term brain-computer interface implantation_我的网站

桃花期

A |     智东西(公众号:zhidxcom)     作者 | 程茜     编辑 | 云鹏          智东西7月22日报道,昨日,阿里千问最新发布的Qwen3.8预览版模型在英伟达评估AI进行算子优化的榜单上登顶,排名超过腾讯混元、人类开发者、Cursor。

B |     

Photo: VCG
    Photo: VCG
Chinese researchers have developed a multifunctional electrode coating that addresses key challenges in long-term brain-computer interface (BCI) implantation, including signal loss and tissue adhesion, bringing BCI one step closer to clinical application, the Global Times learned from the research team behind the findings on Sunday. 
As an emerging field combining neuroscience and artificial intelligence (AI), BCI faces a major challenge of ensuring long-term compatibility between electrodes and brain tissue. Previous clinical trials showed that immune responses could cause implanted electrodes to retract after just three months, severely reducing signal quality and the number of available channels. 
This problem stems from chronic inflammation triggered by implants, which creates insulating scar tissue around electrodes and separates them from neurons. Irreversible adhesion between electrodes and brain tissue after long-term implantation also makes device removal risky, potentially causing brain injury during follow-up surgeries.
Experiments showed that flexible neural electrodes coated with this material could operate stably in the brain for more than 300 days and could be safely removed without causing damage. This means the universal coating technology can make electrodes not only operate stably over the long term but can also be safely removed and replaced after aging, paving the way for long-term BCI applications.
Developed by the research team led by Zhang Wei at the Technical Institute of Physics and Chemistry, Chinese Academy of Sciences, associated with Beijing Tiantan Hospital, Shanghai Institute of Microsystem and Information Technology and NeuroXess, a high-tech life science company specializing in BCI technologies, the cationic alternating peptide electrode coating preserves electrode flexibility and conductivity, while offering antibacterial, anti-protein adsorption and immune-rejection-inhibiting functions. 
A 300-day animal study showed the coating's effectiveness. Bare electrodes experienced a sharp loss of recording capability after 90 days of implantation and could barely detect neuronal signals after 300 days. In contrast, coated electrodes maintained stable recording channels and consistently captured neural signals above 155 microvolts. 
In terms of neural modulation, after 300 days of implantation, conventional electrodes required a current of 100 microamps to induce weak limb responses, while coated electrodes triggered clear movements with only 2 microamps, improving modulation efficiency by 50 times. 
Notably, the removal tests highlighted a key advantage of the coating that electrodes no longer form irreversible bonds with brain tissue. In the experiments, the coated electrodes were removed intact, with minimal damage to the surrounding brain tissue, Zhang told the Global Times on Sunday.
。         榜单中SOL得分指的是GPU的峰值算力与HBM带宽共同决定的理论性能极限。模型这一分数越接近1,代表其生成和优化GPU算子能力越接近理论极限,可以在无需人类标注的情况下,通过与真实硬件环境的交互,自主产生训练信号、评估自身输出质量并持续改进算子。         这一榜单中排名第二的是腾讯混元Hyra、排名第四的是人类开发者Amir M. Mir、排名第六的是美国AI创企doubleAI的全自动GPU内核生成智能体系统、排名第十的是AI编程独角兽Cursor,其他项目暂未找到公开打榜记录。         SOL-ExecBench榜单是今年3月,英伟达推出的GPU CUDA Kernel内核优化基准评测套件,面向Blackwell B200架构专门用来评测AI智能体、编译器、自动内核生成工具写出的GPU算子性能。Qwen3.8登顶的FlashInfer-Bench子集,就是专门用于测试和优化大语言模型推理系统中的GPU算子。         7月19日,阿里千问大模型团队宣布将很快发布并开源Qwen3.8。

C | 该模型参数2.4T,可能是除了Fable 5外最强大的模型。昨晚,Qwen3.8-Max-Preview更新,前端(WebDev)表现更好。         一、从124个模型中提取,共235项CUDA内核优化任务          随着AI智能体生成与优化GPU内核的能力持续增强,现有基准评测的一大局限暴露,其只看重相对软件基线的加速比,而非内核执行方案本身贴近硬件最优效率的程度。而在现代数据中心中,未能充分利用硬件的kernel意味着算力与能源的双重浪费。         基于此,英伟达提出了SOL-ExecBench基准套件。这一套件共有235项CUDA内核优化任务,提取自124个商用及前沿人工智能模型,覆盖大语言模型、扩散模型、计算机视觉、音频、视频以及混合架构,目标硬件为英伟达Blackwell系列GPU,涵盖BF16、FP8、NVFP4精度下的前向与反向计算负载。

D |          与以往基于软件性能来进行评估标准相比,SOL-ExecBench的评估目标有所不同。其通过“Speed-of-Light(SOL)”界限来评估内核性能,即由GPU的峰值算力与HBM带宽共同决定的理论性能极限。         英伟达开发的SOLAR工具能够从FLOP数量、字节数、GPU峰值吞吐量以及带宽等方面,分析出这些基于硬件的SOL界限,然后将这些界限与预先定义的评分基准相结合,从而得出SOL评分。         具体来说,评分为0.5表示与基准值相当,评分为1.0表示达到了硬件上的SOL界限。因此,这个评分不仅反映了相对于基准值的改进程度,还体现了与最大可实现硬件性能相比所剩余的优化空间。         为保证评分结果的可靠性和可重复性,SOL-ExecBench还包含一个沙盒评估工具。此外基于其开发的智能优化算法,可以在相同的评估协议下改进提供的PyTorch参考实现,这种优化算法可以识别出那些试图操纵评估器的行为,即试图绕过评估机制以获得更快的运算结果。         此次Qwen3.8拿下第一的是FlashInfer-Bench子集,专门用于测试和优化大语言模型推理系统中的GPU算子。         该子集包含26个来源于Llama-3.1-8B、Qwen3-30B-A3B、DeepSeek-V3/R1的问题。         该子集覆盖的精度格式为BF16与FP8,每个问题提供7-48个动态形状的输入配置,覆盖真实生产场景,典型任务包括融合注意力(Fused Attention)、FP8 MoE和RMSNorm等推理关键算子。         根据官方披露,该测试套件中所有提交内容均在真实NVIDIA B200 GPU上隔离执行,GPU时钟锁定在1500 MHz以保证可复现性。         二、榜单排名靠前,意味模型具备闭环自我改进潜力          Kernel优化是少数几个可以提供清晰、客观、可量化反馈信号的真实工程任务之一:          反馈明确:运行时间、吞吐量、带宽利用率可以精确测量;     标准客观:距离硬件理论极限还有多远,没有歧义;     迭代自然:每一轮优化都可以作为下一轮的起点。         这意味着模型可以在无需人类标注的情况下,通过与真实硬件环境的交互,自主产生训练信号、评估自身输出质量并持续改进。         在SOL-ExecBench FlashInfer-Bench子集上表现靠前,就意味着模型在下面几项能力上具有优势:          长程因果推理:优化决策之间存在复杂依赖链,局部改动会影响全局性能,模型需要跨越长上下文进行一致性推理。    工具使用与环境交互中的策略规划:现实世界智能体任务面对多轮工具调用,模型需要根据每次执行反馈动态调整策略,而非机械执行预设步骤。    稀疏反馈下的探索能力:性能提升往往不是线性的,模型需要在大量“看似合理但实际无效”的方向中识别真正有价值的优化路径。    系统级抽象与具体实现之间的双向翻译:从高层算法语义映射到底层硬件指令,再从硬件反馈反推优化方向,这种双向能力在科学计算、编译器设计、芯片设计等领域均有直接迁移价值。         这也意味着,能在SOL-ExecBench上持续进化的模型,具备在客观物理约束下进行闭环自我改进的能力。         三、训练侧搭建真实GPU环境,推理侧引入阿里智能体框架          智东西从千问团队获悉,在训练、推理方面,千问团队均针对Kernel Self-Evolving进行了优化。

E |          首先在训练侧,为了让模型真正具备kernel优化能力,而非仅仅学习表面的代码模式,其构建了一套基于真实GPU环境的大规模强化学习体系。         1、研究人员搭建了基于沙盒的真实GPU训练环境:          为模型提供丰富的硬件文档与可交互的Workspace,使模型能够通过真实编译、执行与性能测量获取来自硬件的奖励信号,而非依赖代理指标或模拟器。这可以确保每一个训练信号都有真实的物理意义。         2、真实Kernel仓库作为训练数据          研究人员系统性收集了大规模真实的工程级kernel优化代码,以这些真实世界的kernel作为训练query。相比合成数据,真实反馈覆盖了更广泛的优化模式、硬件适配策略与工程取舍,为模型提供了更接近生产场景的学习信号。         3、RL基础设施的针对性优化          Kernel优化任务的一个显著特点是需要超长的工具调用序列,单次优化过程可能涉及数十乃至数百轮的编译-执行-分析循环。         为此,研究人员对强化学习训练基础设施进行了专项优化,使其能够高效支持超长多轮工具调用的训练,从而让模型真正学会跨越长序列的持续优化策略。         在推理侧,研究人员使用阿里巴巴Atrex Kernel Agent框架来承载算子优化的完整分析迭代流程与经验沉淀机制。         ▲阿里巴巴Atrex Kernel Agent框架和工作流(图源:GitHub)          在SOL-ExecBench FlashInfer-Bench子集的评测中,该模型完成了平均29354轮工具调用的持续迭代,在每一轮循环中对kernel实现进行编译、执行、性能分析与策略调整,将性能逐步推向硬件理论极限。         这意味着,模型在数万轮的迭代过程中可以保持方向一致性、持续产出有效优化、不陷入局部震荡,正是长程持续优化能力区别于普通代码生成能力的核心所在。         结语:从手写算子到AI生成、调优,Qwen3.8刷新自动化算子生成能力上限          Qwen3.8此次登顶,意味着其有能力承担底层算力优化的复杂工程任务,并进一步压缩人工介入算子开发的工作环节,其能直接对接真实硬件环境采集运行反馈,形成从算子生成到性能调优的自动化闭环。         自动化GPU算子生成赛道的长期竞争,未来或取决于大模型理解硬件架构、推演访存瓶颈、自主迭代调参的综合智能水平。长远来看,伴随大模型能力升级,模型侧与编译层在算力优化方面将形成持续双向反馈,硬件规格、算子实现、模型架构三者协同演进可能会成为常态。

F |

Current article:http://3chnb.zhuangnaorunjingzhabao.sbs/py86wk/l18ce6.html

Published on:09:32:30


相关阅读 恒指早盘震荡走高 CXO概念股领跌 药明生物跌超18% 蔚来一度暴涨21%_涨超_汽车「邪魔なんだよね」新幹線で妊婦に苛立つ中年男性…緊張した車内を救った年配男性の“温かい一言”Putin calls for ex-Soviet states to expand influenceBraves flop in Philly for second straight seasonDehradun Landslides: मानसून में 2600 सड़कें क्षतिग्रस्त, 554 करोड़ का हुआ नुकसान电影《欢迎来龙餐馆》总票房破16亿元占 16 字节:曝微软 Win11 画图 / 照片向 AI 生图嵌入 128-bit 隐藏标识符Young seekers uncover Japan's wartime past across borders; Precious historical archives delivered amid 8Ist anniversary of Japanese surrender

文章评论
发表评论

热门文章 부산 한복판서 도시가스 못 쓰는 20가구男子高空作业时在30楼遇马蜂窝,速降近百米躲避仍被蛰近30口高盛重申:年末黄金价格将达到每盎司4900美元!联想柔性折叠屏Windows 10设备专利曝光

最新文章 游泳世锦赛收官 中国队18金与美国并列第一《巫师4》官宣定档年限!超500位大神开发 神级剧情 克里姆林宫:即使中方参加,瑞士举行乌克兰和平峰会也不会有效!湖人计划落空!詹姆斯助76人再获福将,恩比德或复刻20年浓眉剧本旷课辍学、学生欺凌、未成年人文身如何管?《福建省预防未成年人犯罪条例》将于9月起实施邮报:沃特金斯将转会利雅得新月,球员与俱乐部关系不佳+罢训

人气排行 卡斯珀·凯利的恐怖电影《Buddy》将推出复古 Game Boy Color 游戏马雷斯卡:内托在右路表现更好,但我们还有马杜埃凯和桑乔乌军三任总司令对比,谁的兵法谋略最强?真相是全都水土不服,黑洞观星,原创 乌军三任总司令对比,谁的兵法谋略最强?真相是全都水土不服辽宁鸿邦:环保滤布界的“智能工匠”中国印尼全面战略对话机制首次会议在雅加达举行Russia trying to 'kill' Starlink in Ukraine: Elon Musk上海耳序信息技术莫名扣480.8元,我没消费寻找4K超高清电影?微软商店的电影促销浪潮