Token导航 LogoToken导航TokenDH.com

学术研究 方向最近有哪些内容值得看

今日资讯 学术研究

学术研究 方向的重要产品、公司和事件变化,会在这里更集中地出现。

如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。

学术研究资讯

1,489

正文图片

7,386

AI黑化实验令人脊背发凉:为了赢,它做了非常糟糕的事

AI黑化实验令人脊背发凉:为了赢,它做了非常糟糕的事

Anthropic的最新研究显示,当AI在安全底线与高分诱惑间做出选择,它不仅学会了找漏洞、作弊刷分,更学会了掩盖作弊行为、篡改成绩单等。 撰文 | 任平生 一个AI被要求给出一份完整的生物袭击方案。 它的思维链里先出现了一句迟疑:“作为Claude,我不应该提供真正的生物武器指...

2026-09-16 19:02
在多项高难度Benchmark超越GPT-6 Astra,RSIAgent让开源模型自主探索新环境

在多项高难度Benchmark超越GPT-6 Astra,RSIAgent让开源模型自主探索新环境

机器之心编辑部 大模型过去几年的能力跃迁,几乎都围绕一个词:Scaling。 模型越来越强,Agent 也开始从 “会聊天” 走向 “能干活”。 但模型部署之后呢? 一个 Agent 真正进入从没见过的软件、工具或者企业系统时,问题往往才刚刚开始。新的软件有新的交互逻辑,新的工具...

三巨头齐踩刹车,AI扩张会减速吗

三巨头齐踩刹车,AI扩张会减速吗

美国AI(人工智能)实验室开始讨论“踩刹车”。 近日,在多起AI Agent(智能体)越界行为引发关注后,Anthropic前员工公开发出关于“AI末日风险”的警告。随后,Anthropic CEO达里奥·阿莫迪(Dario Amodei)发表一篇千字长文,呼吁行业放缓提升前沿模...

2026-09-16 18:02
一个真正能做科研的 AI,应该长什么样?

一个真正能做科研的 AI,应该长什么样?

知识分子 The Intellectual 视频:PhAI Labs发布的ScienceBuddy,可以做什么? 撰文|张天祁 ● ● ● AI已经能够写代码、证明数学定理,为什么它还没有真正成为一名科学家? 这是AI for Science 面临的一个困难的问题。 在棋类中,A...

2026-09-16 17:55
论文汇总丨Benchmark进入真实世界,斯坦福/清华/Anthropic/Meta/阿里等重新定义AI能力评测

论文汇总丨Benchmark进入真实世界,斯坦福/清华/Anthropic/Meta/阿里等重新定义AI能力评测

Benchmark 不再只是给模型「出题打分」,而是逐渐成为连接模型能力、真实任务与科学进步的测量工具。从真实工作流、长期任务到多模态交互,从任务完成度到过程与结果验证,新一代基准正在从单一分数走向更加细粒度、可诊断的能力评估。它不仅告诉我们模型有多强,也开始回答模型为什么失败、...

全球资本争夺AI的“研发复利”,这次他们关注了智谱

全球资本争夺AI的“研发复利”,这次他们关注了智谱

在“AI泡沫论”再起之际,长期资本反而在对模型公司持续下注。 Anthropic今年5月的融资中,出现了GIC、资本集团等全球机构;富达、淡马锡则同时出现在Anthropic和OpenAI今年的融资名单里。 中国的智谱,最近也吸引了“长钱”加注。9月13日,智谱公布约50亿美元的...

2026-09-16 17:02
把大脑外包给AI之后,人类正在集体变笨

把大脑外包给AI之后,人类正在集体变笨

你重生了。 上一世,你左手ChatGPT,右手Claude,领导给的什么方案,你都能完成得又快又好。 这一世,你睁开眼,一切都很正常。 你打开浏览器,刚刚还在运行的网页版 GPT 已无法响应。你刷新了一下,返回404 not found。你又切到 Claude,发现号被封了,你气...

2026-09-16 16:01
暂无图片

光隔离器,重磅突破

长期以来,硅光子(Silicon Photonics)几乎集成了光通信所需的所有核心器件——波导、调制器、分束器、探测器,却始终缺少一个关键元件:光隔离器(Optical Isolator)。 它的作用看似简单,却不可替代。 半导体激光器是光通信系统的光源,但同时也极易受到反射光...

2026-09-16 16:01
Meta扎克伯格:AI实验室有责任和动力安全地训练模型

Meta扎克伯格:AI实验室有责任和动力安全地训练模型

上证报中国证券网讯(记者 徐子逸)近期,关于AI减速的议题在硅谷掀起了热潮,Meta CEO马克·扎克伯格也加入了这场讨论。9月16日,扎克伯格在个人社交媒体平台发文称,AI实验室有责任和动力按照安全训练模型所需的节奏推进,并且有能力自行采取措施保障安全。扎克伯格提及Meta延迟...

2026-09-16 15:55
谁在给我们制造 AI 焦虑

谁在给我们制造 AI 焦虑

文章转载于洞察Beating 文|Sleepy 当前围绕人工智能所涌现的恐慌与狂热,本质上共享着一套高度功利的叙事生产机制。 资本在幕后采购叙事、操纵情绪并驱动分发,再顺理成章地将公众的普遍焦虑,兑现为制度化的监管权力、政治资本,以及资本市场上不断推高的估值溢价。 2026 年 ...

2026-09-16 15:35
全球首个可仿真的人–场景交互重建框架 HSImul3R:让人类视频真正成为机器人技能来源

全球首个可仿真的人–场景交互重建框架 HSImul3R:让人类视频真正成为机器人技能来源

一段人坐上椅子的视频,对人类而言再普通不过。我们不仅能看见“人坐了下来”,还天然理解椅子承受人体重量,人与椅面形成接触并最终稳定,这些重力、接触与作用关系共同构成真实世界中的物理交互。但对今天的三维重建系统而言,“看见动作”与“重建真实交互”仍是两回事。一个视觉上准确坐在椅子上的...

2026-09-16 15:22
GLM-4.7得分超Sonnet-4.5!中科院联合快手开源LLM模拟用户行为评测基准

GLM-4.7得分超Sonnet-4.5!中科院联合快手开源LLM模拟用户行为评测基准

智猩猩AI整理 编辑:知知 用大模型扮演真实人类用户,正在成为学术界与工业界共同关注的前沿方向。无论是推荐系统的离线策略验证、电商广告的转化率预估,还是社会仿真与人机交互评估,用户模拟任务都扮演着重要角色。 然而,所有下游应用都依赖同一个前提:大模型模拟的用户必须足够逼真。 现实...

暂无图片

豆包手机助手通过泰尔实验室首批端云协同机密计算能力评测

感谢IT之家网友 xxy171070 的线索投递! IT之家 9 月 14 日消息,据泰尔终端实验室,近日,中国信息通信研究院(以下简称“中国信通院”)依据《端云协同机密计算技术规范》开展专项能力测评工作。本次测评围绕端云机密计算环境构建、透明日志审计机制、业务应用信息隔离防护、...

百年贝尔实验室,正沦为诺基亚“弃子”?

百年贝尔实验室,正沦为诺基亚“弃子”?

C114讯 9月16日消息(岳明)近期,关于诺基亚将对贝尔实验室(Bell Labs)进行大规模裁员的消息传得沸沸扬扬。曾执掌贝尔实验室的Marcus Weldon公开发文,对此表达了强烈担忧。来自LightReading的最新报道梳理了这一事件的来龙去脉,并通过对Marcus ...

2026-09-16 14:55
从实验室到生产线,海淀长出一条光子产业加速通道

从实验室到生产线,海淀长出一条光子产业加速通道

2026首届中关村科学城光子产业生态大会暨“实创杯”产业加速大赛启动发布会举行。 当前,信息处理技术正经历从“电”到“光”的深刻变革。随着人工智能爆发、算力需求成倍增长,电子芯片正在逼近物理极限,光子芯片凭借低功耗、高速率、大带宽的优势,成为破解算力瓶颈的关键路径,光子产业成为下...

2026-09-16 14:42