斯坦福大学
不用等了!吴恩达MCP课程来了!
MCP 是一种开放的技术协议,旨在标准化大型语言模型与外部工具和服务的交互方式。吴恩达教授与Anthropic联合推出MCP课程,帮助开发者构建富上下文的AI应用,并连接到不断增长的MCP服务器生态系统。
OpenAI开刀治理GPT-4o “舔狗”病
就在前不久,GPT-4o突然出现过度谄媚的问题。用户反馈其回复内容充满无脑赞美,甚至只是简单打招呼也能得到夸赞。OpenAI随即回滚了版本并承认这一问题影响用户体验和信任。
68页论文再锤大模型竞技场!Llama4发布前私下测试27个版本,只取最佳成绩
大模型竞技场存在系统问题,包括厂商私下测试多个模型版本、数据访问不平等和排名变化快速。研究团队指出,这可能导致排行榜结果失真,并建议改进策略以提高其可信度。
围观!斯坦福最火AI课全球免费开讲,顶级大佬亲授Transformer精髓,课表全放送
斯坦福推出免费在线课程CS25: Transformers United V5,涵盖Transformer架构及其应用,包括语言模型、强化学习、AGI等前沿话题。
LocAgent:斯坦福联合耶鲁大学等机构推出的代码问题定位智能体
LocAgent 是一种基于图表示和大型语言模型(LLM)的代码问题定位框架,能够高效搜索和定位代码库中的相关代码实体,显著提升开发效率。
AI能看懂图像却算不好距离,上交时间-空间智能基准难倒9大顶尖多模态模型
上海交通大学联合团队发布STI-Bench,评估多模态大模型的空间-时间理解能力。结果显示当前最强模型在自动驾驶和机器人操作任务中表现不佳,准确率低于50%。论文、代码及数据已开源,为改善MLLM空间智能提供了新基准。